2.3 MiB
2.3 MiB
Skipping import of cpp extensions due to incompatible torch version 2.10.0a0+rocm7.11.0a20251210 for torchao version 0.14.1 Please see https://github.com/pytorch/ao/issues/2919 for more info
WARNING 12-19 14:58:16 [attention.py:82] Using VLLM_V1_USE_PREFILL_DECODE_ATTENTION environment variable is deprecated and will be removed in v0.14.0 or v1.0.0, whichever is soonest. Please use --attention-config.use_prefill_decode_attention command line argument or AttentionConfig(use_prefill_decode_attention=...) config field instead.
(APIServer pid=58748) INFO 12-19 14:58:16 [api_server.py:1351] vLLM API server version 0.13.0rc2.dev112+g763963aa7.d20251213
(APIServer pid=58748) INFO 12-19 14:58:16 [utils.py:253] non-default args: {'model_tag': 'RedHatAI/Qwen3-14B-FP8-dynamic', 'host': '127.0.0.1', 'model': 'RedHatAI/Qwen3-14B-FP8-dynamic', 'trust_remote_code': True, 'max_model_len': 32768, 'gpu_memory_utilization': 0.98, 'max_num_seqs': 64}
(APIServer pid=58748) The argument `trust_remote_code` is to be used with Auto classes. It has no effect here and is ignored.
(APIServer pid=58748) INFO 12-19 14:58:20 [model.py:514] Resolved architecture: Qwen3ForCausalLM
(APIServer pid=58748) INFO 12-19 14:58:20 [model.py:1636] Using max model len 32768
(APIServer pid=58748) INFO 12-19 14:58:20 [scheduler.py:228] Chunked prefill is enabled with max_num_batched_tokens=2048.
Skipping import of cpp extensions due to incompatible torch version 2.10.0a0+rocm7.11.0a20251210 for torchao version 0.14.1 Please see https://github.com/pytorch/ao/issues/2919 for more info
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:24 [core.py:93] Initializing a V1 LLM engine (v0.13.0rc2.dev112+g763963aa7.d20251213) with config: model='RedHatAI/Qwen3-14B-FP8-dynamic', speculative_config=None, tokenizer='RedHatAI/Qwen3-14B-FP8-dynamic', skip_tokenizer_init=False, tokenizer_mode=auto, revision=None, tokenizer_revision=None, trust_remote_code=True, dtype=torch.bfloat16, max_seq_len=32768, download_dir=None, load_format=auto, tensor_parallel_size=1, pipeline_parallel_size=1, data_parallel_size=1, disable_custom_all_reduce=True, quantization=compressed-tensors, enforce_eager=False, kv_cache_dtype=auto, device_config=cuda, structured_outputs_config=StructuredOutputsConfig(backend='auto', disable_fallback=False, disable_any_whitespace=False, disable_additional_properties=False, reasoning_parser='', reasoning_parser_plugin='', enable_in_reasoning=False), observability_config=ObservabilityConfig(show_hidden_metrics_for_version=None, otlp_traces_endpoint=None, collect_detailed_traces=None, kv_cache_metrics=False, kv_cache_metrics_sample=0.01, cudagraph_metrics=False, enable_layerwise_nvtx_tracing=False), seed=0, served_model_name=RedHatAI/Qwen3-14B-FP8-dynamic, enable_prefix_caching=True, enable_chunked_prefill=True, pooler_config=None, compilation_config={'level': None, 'mode': <CompilationMode.VLLM_COMPILE: 3>, 'debug_dump_path': None, 'cache_dir': '', 'compile_cache_save_format': 'binary', 'backend': 'inductor', 'custom_ops': ['none'], 'splitting_ops': ['vllm::unified_attention', 'vllm::unified_attention_with_output', 'vllm::unified_mla_attention', 'vllm::unified_mla_attention_with_output', 'vllm::mamba_mixer2', 'vllm::mamba_mixer', 'vllm::short_conv', 'vllm::linear_attention', 'vllm::plamo2_mamba_mixer', 'vllm::gdn_attention_core', 'vllm::kda_attention', 'vllm::sparse_attn_indexer'], 'compile_mm_encoder': False, 'compile_sizes': [], 'compile_ranges_split_points': [2048], 'inductor_compile_config': {'enable_auto_functionalized_v2': False, 'combo_kernels': True, 'benchmark_combo_kernel': True}, 'inductor_passes': {}, 'cudagraph_mode': <CUDAGraphMode.FULL_AND_PIECEWISE: (2, 1)>, 'cudagraph_num_of_warmups': 1, 'cudagraph_capture_sizes': [1, 2, 4, 8, 16, 24, 32, 40, 48, 56, 64, 72, 80, 88, 96, 104, 112, 120, 128], 'cudagraph_copy_inputs': False, 'cudagraph_specialize_lora': True, 'use_inductor_graph_partition': False, 'pass_config': {'fuse_norm_quant': False, 'fuse_act_quant': False, 'fuse_attn_quant': False, 'eliminate_noops': True, 'enable_sp': False, 'fuse_gemm_comms': False, 'fuse_allreduce_rms': False}, 'max_cudagraph_capture_size': 128, 'dynamic_shapes_config': {'type': <DynamicShapesType.BACKED: 'backed'>, 'evaluate_guards': False}, 'local_cache_dir': None}
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:24 [parallel_state.py:1203] world_size=1 rank=0 local_rank=0 distributed_init_method=tcp://192.168.1.122:48181 backend=nccl
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:24 [parallel_state.py:1411] rank 0 in world size 1 is assigned as DP rank 0, PP rank 0, PCP rank 0, TP rank 0, EP rank 0
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:24 [gpu_model_runner.py:3562] Starting to load model RedHatAI/Qwen3-14B-FP8-dynamic...
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:25 [rocm.py:306] Using Rocm Attention backend on V1 engine.
Loading safetensors checkpoint shards: 0% Completed | 0/4 [00:00<?, ?it/s]
Loading safetensors checkpoint shards: 25% Completed | 1/4 [00:00<00:00, 3.07it/s]
Loading safetensors checkpoint shards: 50% Completed | 2/4 [00:01<00:01, 1.11it/s]
Loading safetensors checkpoint shards: 75% Completed | 3/4 [00:03<00:01, 1.14s/it]
Loading safetensors checkpoint shards: 100% Completed | 4/4 [00:04<00:00, 1.23s/it]
Loading safetensors checkpoint shards: 100% Completed | 4/4 [00:04<00:00, 1.11s/it]
(EngineCore_DP0 pid=58913)
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:30 [default_loader.py:308] Loading weights took 4.53 seconds
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:30 [gpu_model_runner.py:3659] Model loading took 15.4180 GiB memory and 5.228343 seconds
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:36 [backends.py:634] Using cache directory: /home/kyuz0/.cache/vllm/torch_compile_cache/824e5832da/rank_0_0/backbone for vLLM's torch.compile
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:36 [backends.py:694] Dynamo bytecode transform time: 5.17 s
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:38 [backends.py:261] Cache the graph of compile range (1, 2048) for later use
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:43 [backends.py:278] Compiling a graph for compile range (1, 2048) takes 4.31 s
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:43 [monitor.py:34] torch.compile takes 9.49 s in total
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:45 [gpu_worker.py:375] Available KV cache memory: 14.82 GiB
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:45 [kv_cache_utils.py:1291] GPU KV cache size: 97,088 tokens
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:45 [kv_cache_utils.py:1296] Maximum concurrency for 32,768 tokens per request: 2.96x
Capturing CUDA graphs (mixed prefill-decode, PIECEWISE): 100%|██████████| 19/19 [00:00<00:00, 20.75it/s]
Capturing CUDA graphs (decode, FULL): 100%|██████████| 11/11 [00:00<00:00, 17.97it/s]
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:48 [gpu_model_runner.py:4610] Graph capturing finished in 2 secs, took 1.04 GiB
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:48 [core.py:259] init engine (profile, create kv cache, warmup model) took 17.39 seconds
(APIServer pid=58748) INFO 12-19 14:58:49 [api_server.py:1099] Supported tasks: ['generate']
(APIServer pid=58748) WARNING 12-19 14:58:49 [model.py:1462] Default sampling parameters have been overridden by the model's Hugging Face generation config recommended from the model creator. If this is not intended, please relaunch vLLM instance with `--generation-config vllm`.
(APIServer pid=58748) INFO 12-19 14:58:49 [serving_responses.py:201] Using default chat sampling params from model: {'temperature': 0.6, 'top_k': 20, 'top_p': 0.95}
(APIServer pid=58748) INFO 12-19 14:58:49 [serving_chat.py:137] Using default chat sampling params from model: {'temperature': 0.6, 'top_k': 20, 'top_p': 0.95}
(APIServer pid=58748) INFO 12-19 14:58:50 [serving_completion.py:77] Using default completion sampling params from model: {'temperature': 0.6, 'top_k': 20, 'top_p': 0.95}
(APIServer pid=58748) INFO 12-19 14:58:50 [serving_chat.py:137] Using default chat sampling params from model: {'temperature': 0.6, 'top_k': 20, 'top_p': 0.95}
(APIServer pid=58748) INFO 12-19 14:58:50 [api_server.py:1425] Starting vLLM API server 0 on http://127.0.0.1:8000
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:38] Available routes are:
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /openapi.json, Methods: GET, HEAD
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /docs, Methods: GET, HEAD
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /docs/oauth2-redirect, Methods: GET, HEAD
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /redoc, Methods: GET, HEAD
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /scale_elastic_ep, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /is_scaling_elastic_ep, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /tokenize, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /detokenize, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /inference/v1/generate, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /pause, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /resume, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /is_paused, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /metrics, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /health, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /load, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/models, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /version, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/responses, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/responses/{response_id}, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/responses/{response_id}/cancel, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/messages, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/chat/completions, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/completions, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/audio/transcriptions, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/audio/translations, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /ping, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /ping, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /invocations, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /classify, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/embeddings, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /score, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/score, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /rerank, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/rerank, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v2/rerank, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /pooling, Methods: POST
(APIServer pid=58748) INFO: Started server process [58748]
(APIServer pid=58748) INFO: Waiting for application startup.
(APIServer pid=58748) INFO: Application startup complete.
(APIServer pid=58748) INFO: 127.0.0.1:41284 - "GET /v1/models HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43854 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 14:59:10 [loggers.py:248] Engine 000: Avg prompt throughput: 7.4 tokens/s, Avg generation throughput: 22.3 tokens/s, Running: 3 reqs, Waiting: 0 reqs, GPU KV cache usage: 0.2%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 14:59:20 [loggers.py:248] Engine 000: Avg prompt throughput: 131.2 tokens/s, Avg generation throughput: 114.0 tokens/s, Running: 4 reqs, Waiting: 0 reqs, GPU KV cache usage: 0.9%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43854 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:46026 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:46026 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 14:59:30 [loggers.py:248] Engine 000: Avg prompt throughput: 224.6 tokens/s, Avg generation throughput: 163.7 tokens/s, Running: 8 reqs, Waiting: 0 reqs, GPU KV cache usage: 2.8%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43854 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 14:59:40 [loggers.py:248] Engine 000: Avg prompt throughput: 279.4 tokens/s, Avg generation throughput: 209.9 tokens/s, Running: 9 reqs, Waiting: 0 reqs, GPU KV cache usage: 4.6%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 14:59:50 [loggers.py:248] Engine 000: Avg prompt throughput: 217.3 tokens/s, Avg generation throughput: 175.6 tokens/s, Running: 9 reqs, Waiting: 0 reqs, GPU KV cache usage: 3.6%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43854 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45826 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:46026 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43854 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:00:00 [loggers.py:248] Engine 000: Avg prompt throughput: 375.3 tokens/s, Avg generation throughput: 211.1 tokens/s, Running: 10 reqs, Waiting: 0 reqs, GPU KV cache usage: 3.8%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45828 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45826 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43854 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45826 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:00:10 [loggers.py:248] Engine 000: Avg prompt throughput: 405.3 tokens/s, Avg generation throughput: 229.8 tokens/s, Running: 11 reqs, Waiting: 0 reqs, GPU KV cache usage: 4.2%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45828 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45826 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:00:20 [loggers.py:248] Engine 000: Avg prompt throughput: 215.3 tokens/s, Avg generation throughput: 206.3 tokens/s, Running: 6 reqs, Waiting: 0 reqs, GPU KV cache usage: 3.7%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45828 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60990 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60998 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50760 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:00:30 [loggers.py:248] Engine 000: Avg prompt throughput: 298.4 tokens/s, Avg generation throughput: 214.2 tokens/s, Running: 12 reqs, Waiting: 0 reqs, GPU KV cache usage: 3.9%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60998 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50776 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47046 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60990 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60990 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:00:40 [loggers.py:248] Engine 000: Avg prompt throughput: 301.7 tokens/s, Avg generation throughput: 287.0 tokens/s, Running: 15 reqs, Waiting: 0 reqs, GPU KV cache usage: 5.7%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:60990 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60990 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60990 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:00:50 [loggers.py:248] Engine 000: Avg prompt throughput: 156.0 tokens/s, Avg generation throughput: 311.6 tokens/s, Running: 12 reqs, Waiting: 0 reqs, GPU KV cache usage: 5.3%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50760 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50776 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50760 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45828 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:01:00 [loggers.py:248] Engine 000: Avg prompt throughput: 41.1 tokens/s, Avg generation throughput: 249.5 tokens/s, Running: 8 reqs, Waiting: 0 reqs, GPU KV cache usage: 2.3%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50760 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:01:10 [loggers.py:248] Engine 000: Avg prompt throughput: 232.2 tokens/s, Avg generation throughput: 195.4 tokens/s, Running: 9 reqs, Waiting: 0 reqs, GPU KV cache usage: 3.6%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42624 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42630 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42642 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42630 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45828 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42624 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:01:20 [loggers.py:248] Engine 000: Avg prompt throughput: 219.2 tokens/s, Avg generation throughput: 243.5 tokens/s, Running: 9 reqs, Waiting: 0 reqs, GPU KV cache usage: 2.9%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42630 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:01:30 [loggers.py:248] Engine 000: Avg prompt throughput: 152.8 tokens/s, Avg generation throughput: 244.1 tokens/s, Running: 8 reqs, Waiting: 0 reqs, GPU KV cache usage: 2.8%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42624 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42630 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:01:40 [loggers.py:248] Engine 000: Avg prompt throughput: 70.6 tokens/s, Avg generation throughput: 153.3 tokens/s, Running: 5 reqs, Waiting: 0 reqs, GPU KV cache usage: 3.0%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50760 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42642 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45828 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47332 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47338 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47358 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45828 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:01:50 [loggers.py:248] Engine 000: Avg prompt throughput: 172.9 tokens/s, Avg generation throughput: 174.6 tokens/s, Running: 9 reqs, Waiting: 0 reqs, GPU KV cache usage: 2.5%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47358 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47338 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33208 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47338 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47358 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50760 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:02:00 [loggers.py:248] Engine 000: Avg prompt throughput: 130.7 tokens/s, Avg generation throughput: 178.8 tokens/s, Running: 9 reqs, Waiting: 0 reqs, GPU KV cache usage: 3.6%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:33220 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33222 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50760 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33226 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33226 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42630 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42630 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42630 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33208 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37980 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:02:10 [loggers.py:248] Engine 000: Avg prompt throughput: 205.6 tokens/s, Avg generation throughput: 257.8 tokens/s, Running: 9 reqs, Waiting: 0 reqs, GPU KV cache usage: 4.1%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO 12-19 15:02:20 [loggers.py:248] Engine 000: Avg prompt throughput: 0.0 tokens/s, Avg generation throughput: 150.2 tokens/s, Running: 4 reqs, Waiting: 0 reqs, GPU KV cache usage: 2.8%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO 12-19 15:02:30 [loggers.py:248] Engine 000: Avg prompt throughput: 0.0 tokens/s, Avg generation throughput: 48.8 tokens/s, Running: 0 reqs, Waiting: 0 reqs, GPU KV cache usage: 0.0%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50742 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:02:40 [loggers.py:248] Engine 000: Avg prompt throughput: 116.7 tokens/s, Avg generation throughput: 32.7 tokens/s, Running: 7 reqs, Waiting: 0 reqs, GPU KV cache usage: 1.0%, Prefix cache hit rate: 2.8%
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50820 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50844 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50742 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:02:50 [loggers.py:248] Engine 000: Avg prompt throughput: 872.1 tokens/s, Avg generation throughput: 362.0 tokens/s, Running: 23 reqs, Waiting: 0 reqs, GPU KV cache usage: 6.9%, Prefix cache hit rate: 19.7%
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60710 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50844 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50820 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50844 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60710 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50844 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52246 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50742 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:03:00 [loggers.py:248] Engine 000: Avg prompt throughput: 1193.2 tokens/s, Avg generation throughput: 704.1 tokens/s, Running: 39 reqs, Waiting: 0 reqs, GPU KV cache usage: 14.6%, Prefix cache hit rate: 34.9%
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60710 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51306 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51312 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50844 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:03:10 [loggers.py:248] Engine 000: Avg prompt throughput: 863.9 tokens/s, Avg generation throughput: 801.8 tokens/s, Running: 46 reqs, Waiting: 0 reqs, GPU KV cache usage: 17.4%, Prefix cache hit rate: 42.5%
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51306 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51362 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52246 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:03:20 [loggers.py:248] Engine 000: Avg prompt throughput: 465.3 tokens/s, Avg generation throughput: 907.6 tokens/s, Running: 44 reqs, Waiting: 0 reqs, GPU KV cache usage: 17.7%, Prefix cache hit rate: 45.9%
(APIServer pid=58748) INFO: 127.0.0.1:51362 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50742 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52246 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51362 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51362 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50844 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:03:30 [loggers.py:248] Engine 000: Avg prompt throughput: 902.6 tokens/s, Avg generation throughput: 804.9 tokens/s, Running: 44 reqs, Waiting: 0 reqs, GPU KV cache usage: 19.0%, Prefix cache hit rate: 44.6%
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37584 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50820 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51306 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50820 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:03:40 [loggers.py:248] Engine 000: Avg prompt throughput: 1066.5 tokens/s, Avg generation throughput: 823.5 tokens/s, Running: 56 reqs, Waiting: 0 reqs, GPU KV cache usage: 21.8%, Prefix cache hit rate: 39.5%
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50832 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52246 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50742 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50832 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:03:50 [loggers.py:248] Engine 000: Avg prompt throughput: 615.9 tokens/s, Avg generation throughput: 907.6 tokens/s, Running: 50 reqs, Waiting: 0 reqs, GPU KV cache usage: 19.7%, Prefix cache hit rate: 37.1%
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52246 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50844 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60710 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51312 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51312 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60710 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37584 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38242 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38252 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38254 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:04:00 [loggers.py:248] Engine 000: Avg prompt throughput: 820.7 tokens/s, Avg generation throughput: 871.6 tokens/s, Running: 62 reqs, Waiting: 0 reqs, GPU KV cache usage: 18.3%, Prefix cache hit rate: 34.2%
(APIServer pid=58748) INFO: 127.0.0.1:38270 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38284 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38242 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38294 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38302 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38284 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38308 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38242 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51362 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38302 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50820 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38308 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38284 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38294 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50742 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38284 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38302 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50742 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38284 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51306 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:04:10 [loggers.py:248] Engine 000: Avg prompt throughput: 713.4 tokens/s, Avg generation throughput: 1065.9 tokens/s, Running: 61 reqs, Waiting: 0 reqs, GPU KV cache usage: 19.8%, Prefix cache hit rate: 32.1%
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50832 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38302 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50820 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52246 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50832 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38302 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52246 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51362 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:04:20 [loggers.py:248] Engine 000: Avg prompt throughput: 894.7 tokens/s, Avg generation throughput: 917.3 tokens/s, Running: 60 reqs, Waiting: 0 reqs, GPU KV cache usage: 20.2%, Prefix cache hit rate: 29.8%
(APIServer pid=58748) INFO: 127.0.0.1:37584 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38252 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51362 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38294 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38284 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38270 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:04:30 [loggers.py:248] Engine 000: Avg prompt throughput: 916.1 tokens/s, Avg generation throughput: 792.1 tokens/s, Running: 38 reqs, Waiting: 0 reqs, GPU KV cache usage: 15.6%, Prefix cache hit rate: 27.7%
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38254 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38302 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60710 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:04:40 [loggers.py:248] Engine 000: Avg prompt throughput: 364.6 tokens/s, Avg generation throughput: 790.1 tokens/s, Running: 32 reqs, Waiting: 0 reqs, GPU KV cache usage: 11.6%, Prefix cache hit rate: 27.0%
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51312 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38294 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38270 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38308 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38254 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:04:50 [loggers.py:248] Engine 000: Avg prompt throughput: 837.6 tokens/s, Avg generation throughput: 751.2 tokens/s, Running: 48 reqs, Waiting: 0 reqs, GPU KV cache usage: 14.6%, Prefix cache hit rate: 25.6%
(APIServer pid=58748) INFO: 127.0.0.1:51306 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43348 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43352 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43358 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43374 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51312 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43352 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38270 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38308 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43352 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43348 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38308 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43374 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51312 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43348 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:05:00 [loggers.py:248] Engine 000: Avg prompt throughput: 1054.8 tokens/s, Avg generation throughput: 785.9 tokens/s, Running: 37 reqs, Waiting: 0 reqs, GPU KV cache usage: 13.6%, Prefix cache hit rate: 23.8%
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38308 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38254 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43358 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38302 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51306 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43348 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38294 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:05:10 [loggers.py:248] Engine 000: Avg prompt throughput: 585.7 tokens/s, Avg generation throughput: 731.1 tokens/s, Running: 39 reqs, Waiting: 0 reqs, GPU KV cache usage: 13.1%, Prefix cache hit rate: 23.0%
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43358 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38308 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51312 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38254 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43374 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:05:20 [loggers.py:248] Engine 000: Avg prompt throughput: 740.6 tokens/s, Avg generation throughput: 771.9 tokens/s, Running: 44 reqs, Waiting: 0 reqs, GPU KV cache usage: 15.0%, Prefix cache hit rate: 22.0%
(APIServer pid=58748) INFO: 127.0.0.1:38270 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60710 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38254 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51306 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38294 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38294 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [dump_input.py:72] Dumping input data for V1 LLM engine (v0.13.0rc2.dev112+g763963aa7.d20251213) with config: model='RedHatAI/Qwen3-14B-FP8-dynamic', speculative_config=None, tokenizer='RedHatAI/Qwen3-14B-FP8-dynamic', skip_tokenizer_init=False, tokenizer_mode=auto, revision=None, tokenizer_revision=None, trust_remote_code=True, dtype=torch.bfloat16, max_seq_len=32768, download_dir=None, load_format=auto, tensor_parallel_size=1, pipeline_parallel_size=1, data_parallel_size=1, disable_custom_all_reduce=True, quantization=compressed-tensors, enforce_eager=False, kv_cache_dtype=auto, device_config=cuda, structured_outputs_config=StructuredOutputsConfig(backend='auto', disable_fallback=False, disable_any_whitespace=False, disable_additional_properties=False, reasoning_parser='', reasoning_parser_plugin='', enable_in_reasoning=False), observability_config=ObservabilityConfig(show_hidden_metrics_for_version=None, otlp_traces_endpoint=None, collect_detailed_traces=None, kv_cache_metrics=False, kv_cache_metrics_sample=0.01, cudagraph_metrics=False, enable_layerwise_nvtx_tracing=False), seed=0, served_model_name=RedHatAI/Qwen3-14B-FP8-dynamic, enable_prefix_caching=True, enable_chunked_prefill=True, pooler_config=None, compilation_config={'level': None, 'mode': <CompilationMode.VLLM_COMPILE: 3>, 'debug_dump_path': None, 'cache_dir': '/home/kyuz0/.cache/vllm/torch_compile_cache/824e5832da', 'compile_cache_save_format': 'binary', 'backend': 'inductor', 'custom_ops': ['none'], 'splitting_ops': ['vllm::unified_attention', 'vllm::unified_attention_with_output', 'vllm::unified_mla_attention', 'vllm::unified_mla_attention_with_output', 'vllm::mamba_mixer2', 'vllm::mamba_mixer', 'vllm::short_conv', 'vllm::linear_attention', 'vllm::plamo2_mamba_mixer', 'vllm::gdn_attention_core', 'vllm::kda_attention', 'vllm::sparse_attn_indexer'], 'compile_mm_encoder': False, 'compile_sizes': [], 'compile_ranges_split_points': [2048], 'inductor_compile_config': {'enable_auto_functionalized_v2': False, 'combo_kernels': True, 'benchmark_combo_kernel': True}, 'inductor_passes': {}, 'cudagraph_mode': <CUDAGraphMode.FULL_AND_PIECEWISE: (2, 1)>, 'cudagraph_num_of_warmups': 1, 'cudagraph_capture_sizes': [1, 2, 4, 8, 16, 24, 32, 40, 48, 56, 64, 72, 80, 88, 96, 104, 112, 120, 128], 'cudagraph_copy_inputs': False, 'cudagraph_specialize_lora': True, 'use_inductor_graph_partition': False, 'pass_config': {'fuse_norm_quant': False, 'fuse_act_quant': False, 'fuse_attn_quant': False, 'eliminate_noops': True, 'enable_sp': False, 'fuse_gemm_comms': False, 'fuse_allreduce_rms': False}, 'max_cudagraph_capture_size': 128, 'dynamic_shapes_config': {'type': <DynamicShapesType.BACKED: 'backed'>, 'evaluate_guards': False}, 'local_cache_dir': '/home/kyuz0/.cache/vllm/torch_compile_cache/824e5832da/rank_0_0/backbone'},
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [dump_input.py:79] Dumping scheduler output for model execution: SchedulerOutput(scheduled_new_reqs=[NewRequestData(req_id=cmpl-bench-959ca2a7-668-0,prompt_token_ids_len=597,mm_features=[],sampling_params=SamplingParams(n=1, presence_penalty=0.0, frequency_penalty=0.0, repetition_penalty=1.0, temperature=0.0, top_p=1.0, top_k=0, min_p=0.0, seed=None, stop=[], stop_token_ids=[151643], bad_words=[], include_stop_str_in_output=False, ignore_eos=False, max_tokens=11, min_tokens=0, logprobs=None, prompt_logprobs=None, skip_special_tokens=True, spaces_between_special_tokens=True, truncate_prompt_tokens=None, structured_outputs=None, extra_args=None),block_ids=([2457, 311, 4955, 4403, 501, 1834, 3391, 1462, 679, 1386, 2343, 978, 2420, 2359, 2291, 1348, 611, 4569, 4357, 1443, 2301, 4246, 3135, 4341, 5307, 1176, 1744, 4249, 2188, 1792, 1334, 4950, 562, 5082, 127, 4989, 4837, 4530],),num_computed_tokens=0,lora_request=None,prompt_embeds_shape=None)], scheduled_cached_reqs=CachedRequestData(req_ids=['cmpl-bench-959ca2a7-518-0', 'cmpl-bench-959ca2a7-553-0', 'cmpl-bench-959ca2a7-573-0', 'cmpl-bench-959ca2a7-582-0', 'cmpl-bench-959ca2a7-586-0', 'cmpl-bench-959ca2a7-596-0', 'cmpl-bench-959ca2a7-602-0', 'cmpl-bench-959ca2a7-606-0', 'cmpl-bench-959ca2a7-607-0', 'cmpl-bench-959ca2a7-608-0', 'cmpl-bench-959ca2a7-609-0', 'cmpl-bench-959ca2a7-613-0', 'cmpl-bench-959ca2a7-617-0', 'cmpl-bench-959ca2a7-619-0', 'cmpl-bench-959ca2a7-622-0', 'cmpl-bench-959ca2a7-624-0', 'cmpl-bench-959ca2a7-625-0', 'cmpl-bench-959ca2a7-626-0', 'cmpl-bench-959ca2a7-627-0', 'cmpl-bench-959ca2a7-628-0', 'cmpl-bench-959ca2a7-630-0', 'cmpl-bench-959ca2a7-631-0', 'cmpl-bench-959ca2a7-632-0', 'cmpl-bench-959ca2a7-633-0', 'cmpl-bench-959ca2a7-634-0', 'cmpl-bench-959ca2a7-635-0', 'cmpl-bench-959ca2a7-636-0', 'cmpl-bench-959ca2a7-637-0', 'cmpl-bench-959ca2a7-638-0', 'cmpl-bench-959ca2a7-639-0', 'cmpl-bench-959ca2a7-640-0', 'cmpl-bench-959ca2a7-641-0', 'cmpl-bench-959ca2a7-642-0', 'cmpl-bench-959ca2a7-643-0', 'cmpl-bench-959ca2a7-648-0', 'cmpl-bench-959ca2a7-649-0', 'cmpl-bench-959ca2a7-650-0', 'cmpl-bench-959ca2a7-655-0', 'cmpl-bench-959ca2a7-656-0', 'cmpl-bench-959ca2a7-658-0', 'cmpl-bench-959ca2a7-659-0', 'cmpl-bench-959ca2a7-660-0', 'cmpl-bench-959ca2a7-661-0', 'cmpl-bench-959ca2a7-662-0', 'cmpl-bench-959ca2a7-663-0', 'cmpl-bench-959ca2a7-664-0', 'cmpl-bench-959ca2a7-665-0', 'cmpl-bench-959ca2a7-666-0', 'cmpl-bench-959ca2a7-667-0'], resumed_req_ids=[], new_token_ids=[], all_token_ids={}, new_block_ids=[null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, [[585]], null, null, null, null, null, [[1203]], null, null, null, null, null, [[4226]], null, null, null, null, [[5315]], null, null, null, null, null, null, null, null], num_computed_tokens=[743, 623, 1340, 663, 450, 395, 767, 317, 374, 461, 386, 385, 486, 541, 231, 211, 856, 191, 183, 185, 204, 191, 242, 224, 166, 168, 173, 157, 951, 352, 143, 121, 230, 115, 193, 80, 129, 58, 175, 52, 32, 104, 25, 25, 781, 533, 22, 622, 583], num_output_tokens=[738, 606, 483, 434, 426, 353, 318, 312, 311, 307, 305, 285, 277, 238, 227, 198, 186, 181, 175, 173, 172, 171, 171, 167, 159, 143, 142, 142, 137, 133, 124, 110, 89, 86, 65, 65, 61, 49, 48, 45, 25, 23, 12, 12, 10, 9, 8, 4, 3]), num_scheduled_tokens={cmpl-bench-959ca2a7-613-0: 1, cmpl-bench-959ca2a7-602-0: 1, cmpl-bench-959ca2a7-622-0: 1, cmpl-bench-959ca2a7-518-0: 1, cmpl-bench-959ca2a7-617-0: 1, cmpl-bench-959ca2a7-655-0: 1, cmpl-bench-959ca2a7-643-0: 1, cmpl-bench-959ca2a7-663-0: 1, cmpl-bench-959ca2a7-596-0: 1, cmpl-bench-959ca2a7-637-0: 1, cmpl-bench-959ca2a7-631-0: 1, cmpl-bench-959ca2a7-638-0: 1, cmpl-bench-959ca2a7-573-0: 1, cmpl-bench-959ca2a7-642-0: 1, cmpl-bench-959ca2a7-619-0: 1, cmpl-bench-959ca2a7-607-0: 1, cmpl-bench-959ca2a7-658-0: 1, cmpl-bench-959ca2a7-635-0: 1, cmpl-bench-959ca2a7-632-0: 1, cmpl-bench-959ca2a7-634-0: 1, cmpl-bench-959ca2a7-633-0: 1, cmpl-bench-959ca2a7-662-0: 1, cmpl-bench-959ca2a7-659-0: 1, cmpl-bench-959ca2a7-630-0: 1, cmpl-bench-959ca2a7-624-0: 1, cmpl-bench-959ca2a7-628-0: 1, cmpl-bench-959ca2a7-667-0: 1, cmpl-bench-959ca2a7-606-0: 1, cmpl-bench-959ca2a7-626-0: 1, cmpl-bench-959ca2a7-553-0: 1, cmpl-bench-959ca2a7-608-0: 1, cmpl-bench-959ca2a7-661-0: 1, cmpl-bench-959ca2a7-664-0: 1, cmpl-bench-959ca2a7-627-0: 1, cmpl-bench-959ca2a7-641-0: 1, cmpl-bench-959ca2a7-649-0: 1, cmpl-bench-959ca2a7-656-0: 1, cmpl-bench-959ca2a7-636-0: 1, cmpl-bench-959ca2a7-625-0: 1, cmpl-bench-959ca2a7-639-0: 1, cmpl-bench-959ca2a7-648-0: 1, cmpl-bench-959ca2a7-666-0: 1, cmpl-bench-959ca2a7-609-0: 1, cmpl-bench-959ca2a7-665-0: 1, cmpl-bench-959ca2a7-668-0: 597, cmpl-bench-959ca2a7-660-0: 1, cmpl-bench-959ca2a7-640-0: 1, cmpl-bench-959ca2a7-586-0: 1, cmpl-bench-959ca2a7-650-0: 1, cmpl-bench-959ca2a7-582-0: 1}, total_num_scheduled_tokens=646, scheduled_spec_decode_tokens={}, scheduled_encoder_inputs={}, num_common_prefix_blocks=[0], finished_req_ids=[], free_encoder_mm_hashes=[], preempted_req_ids=[], pending_structured_output_tokens=false, kv_connector_metadata=null, ec_connector_metadata=null)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [dump_input.py:81] Dumping scheduler stats: SchedulerStats(num_running_reqs=50, num_waiting_reqs=0, step_counter=0, current_wave=0, kv_cache_usage=0.181803197626504, prefix_cache_stats=PrefixCacheStats(reset=False, requests=1, queries=597, hits=0, preempted_requests=0, preempted_queries=0, preempted_hits=0), connector_prefix_cache_stats=None, kv_cache_eviction_events=[], spec_decoding_stats=None, kv_connector_stats=None, waiting_lora_adapters={}, running_lora_adapters={}, cudagraph_stats=None)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] EngineCore encountered a fatal error.
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] Traceback (most recent call last):
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 859, in run_engine_core
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] engine_core.run_busy_loop()
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ~~~~~~~~~~~~~~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 886, in run_busy_loop
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] self._process_engine_step()
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ~~~~~~~~~~~~~~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 919, in _process_engine_step
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] outputs, model_executed = self.step_fn()
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 353, in step
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] model_output = self.model_executor.sample_tokens(grammar_output)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/uniproc_executor.py", line 110, in sample_tokens
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] return self.collective_rpc(
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ~~~~~~~~~~~~~~~~~~~^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] "sample_tokens",
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ...<2 lines>...
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] single_value=True,
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ^^^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] )
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/uniproc_executor.py", line 75, in collective_rpc
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] result = run_method(self.driver_worker, method, args, kwargs)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/serial_utils.py", line 461, in run_method
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] return func(*args, **kwargs)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/torch/utils/_contextlib.py", line 124, in decorate_context
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] return func(*args, **kwargs)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_worker.py", line 572, in sample_tokens
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] return self.model_runner.sample_tokens(grammar_output)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/torch/utils/_contextlib.py", line 124, in decorate_context
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] return func(*args, **kwargs)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 3281, in sample_tokens
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ) = self._bookkeeping_sync(
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ~~~~~~~~~~~~~~~~~~~~~~^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] scheduler_output,
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ^^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ...<4 lines>...
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] spec_decode_metadata,
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ^^^^^^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] )
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 2625, in _bookkeeping_sync
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] valid_sampled_token_ids = self._to_list(sampled_token_ids)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 5492, in _to_list
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] self.transfer_event.synchronize()
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] torch.AcceleratorError: HIP error: an illegal memory access was encountered
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] Search for `hipErrorIllegalAddress' in https://rocm.docs.amd.com/projects/HIP/en/latest/index.html for more information.
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] HIP kernel errors might be asynchronously reported at some other API call, so the stacktrace below might be incorrect.
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] For debugging consider passing AMD_SERIALIZE_KERNEL=3
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] Compile with `TORCH_USE_HIP_DSA` to enable device-side assertions.
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868]
(EngineCore_DP0 pid=58913) Process EngineCore_DP0:
(EngineCore_DP0 pid=58913) Traceback (most recent call last):
(EngineCore_DP0 pid=58913) File "/usr/lib64/python3.13/multiprocessing/process.py", line 313, in _bootstrap
(EngineCore_DP0 pid=58913) self.run()
(EngineCore_DP0 pid=58913) ~~~~~~~~^^
(EngineCore_DP0 pid=58913) File "/usr/lib64/python3.13/multiprocessing/process.py", line 108, in run
(EngineCore_DP0 pid=58913) self._target(*self._args, **self._kwargs)
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 870, in run_engine_core
(EngineCore_DP0 pid=58913) raise e
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 859, in run_engine_core
(EngineCore_DP0 pid=58913) engine_core.run_busy_loop()
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~~~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 886, in run_busy_loop
(EngineCore_DP0 pid=58913) self._process_engine_step()
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~~~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 919, in _process_engine_step
(EngineCore_DP0 pid=58913) outputs, model_executed = self.step_fn()
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 353, in step
(EngineCore_DP0 pid=58913) model_output = self.model_executor.sample_tokens(grammar_output)
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/uniproc_executor.py", line 110, in sample_tokens
(EngineCore_DP0 pid=58913) return self.collective_rpc(
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~~~~~~~~^
(EngineCore_DP0 pid=58913) "sample_tokens",
(EngineCore_DP0 pid=58913) ^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) ...<2 lines>...
(EngineCore_DP0 pid=58913) single_value=True,
(EngineCore_DP0 pid=58913) ^^^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) )
(EngineCore_DP0 pid=58913) ^
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/uniproc_executor.py", line 75, in collective_rpc
(EngineCore_DP0 pid=58913) result = run_method(self.driver_worker, method, args, kwargs)
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/serial_utils.py", line 461, in run_method
(EngineCore_DP0 pid=58913) return func(*args, **kwargs)
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/torch/utils/_contextlib.py", line 124, in decorate_context
(EngineCore_DP0 pid=58913) return func(*args, **kwargs)
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_worker.py", line 572, in sample_tokens
(EngineCore_DP0 pid=58913) return self.model_runner.sample_tokens(grammar_output)
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/torch/utils/_contextlib.py", line 124, in decorate_context
(EngineCore_DP0 pid=58913) return func(*args, **kwargs)
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 3281, in sample_tokens
(EngineCore_DP0 pid=58913) ) = self._bookkeeping_sync(
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~~~~~~~~~~~^
(EngineCore_DP0 pid=58913) scheduler_output,
(EngineCore_DP0 pid=58913) ^^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) ...<4 lines>...
(EngineCore_DP0 pid=58913) spec_decode_metadata,
(EngineCore_DP0 pid=58913) ^^^^^^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) )
(EngineCore_DP0 pid=58913) ^
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 2625, in _bookkeeping_sync
(EngineCore_DP0 pid=58913) valid_sampled_token_ids = self._to_list(sampled_token_ids)
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 5492, in _to_list
(EngineCore_DP0 pid=58913) self.transfer_event.synchronize()
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) torch.AcceleratorError: HIP error: an illegal memory access was encountered
(EngineCore_DP0 pid=58913) Search for `hipErrorIllegalAddress' in https://rocm.docs.amd.com/projects/HIP/en/latest/index.html for more information.
(EngineCore_DP0 pid=58913) HIP kernel errors might be asynchronously reported at some other API call, so the stacktrace below might be incorrect.
(EngineCore_DP0 pid=58913) For debugging consider passing AMD_SERIALIZE_KERNEL=3
(EngineCore_DP0 pid=58913) Compile with `TORCH_USE_HIP_DSA` to enable device-side assertions.
(EngineCore_DP0 pid=58913)
[rank0]:[W1219 15:05:29.875861010 ProcessGroupNCCL.cpp:1553] Warning: WARNING: destroy_process_group() was not called before program exit, which can leak resources. For more info, please see https://pytorch.org/docs/stable/distributed.html#shutdown (function operator())
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] AsyncLLM output_handler failed.
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
hipModuleUnload failed:
error: an illegal memory access was encountered
hipModuleUnload failed:
error: an illegal memory access was encountered
hipModuleUnload failed:
error: an illegal memory access was encountered
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 500 Internal Server Error
(APIServer pid=58748) INFO: 127.0.0.1:52514 - "POST /v1/completions HTTP/1.1" 500 Internal Server Error
(APIServer pid=58748) INFO: 127.0.0.1:52528 - "POST /v1/completions HTTP/1.1" 500 Internal Server Error
(APIServer pid=58748) INFO: Shutting down
(APIServer pid=58748) INFO: Waiting for application shutdown.
(APIServer pid=58748) INFO: Application shutdown complete.
(APIServer pid=58748) INFO: Finished server process [58748]
WARNING 12-19 14:58:16 [attention.py:82] Using VLLM_V1_USE_PREFILL_DECODE_ATTENTION environment variable is deprecated and will be removed in v0.14.0 or v1.0.0, whichever is soonest. Please use --attention-config.use_prefill_decode_attention command line argument or AttentionConfig(use_prefill_decode_attention=...) config field instead.
(APIServer pid=58748) INFO 12-19 14:58:16 [api_server.py:1351] vLLM API server version 0.13.0rc2.dev112+g763963aa7.d20251213
(APIServer pid=58748) INFO 12-19 14:58:16 [utils.py:253] non-default args: {'model_tag': 'RedHatAI/Qwen3-14B-FP8-dynamic', 'host': '127.0.0.1', 'model': 'RedHatAI/Qwen3-14B-FP8-dynamic', 'trust_remote_code': True, 'max_model_len': 32768, 'gpu_memory_utilization': 0.98, 'max_num_seqs': 64}
(APIServer pid=58748) The argument `trust_remote_code` is to be used with Auto classes. It has no effect here and is ignored.
(APIServer pid=58748) INFO 12-19 14:58:20 [model.py:514] Resolved architecture: Qwen3ForCausalLM
(APIServer pid=58748) INFO 12-19 14:58:20 [model.py:1636] Using max model len 32768
(APIServer pid=58748) INFO 12-19 14:58:20 [scheduler.py:228] Chunked prefill is enabled with max_num_batched_tokens=2048.
Skipping import of cpp extensions due to incompatible torch version 2.10.0a0+rocm7.11.0a20251210 for torchao version 0.14.1 Please see https://github.com/pytorch/ao/issues/2919 for more info
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:24 [core.py:93] Initializing a V1 LLM engine (v0.13.0rc2.dev112+g763963aa7.d20251213) with config: model='RedHatAI/Qwen3-14B-FP8-dynamic', speculative_config=None, tokenizer='RedHatAI/Qwen3-14B-FP8-dynamic', skip_tokenizer_init=False, tokenizer_mode=auto, revision=None, tokenizer_revision=None, trust_remote_code=True, dtype=torch.bfloat16, max_seq_len=32768, download_dir=None, load_format=auto, tensor_parallel_size=1, pipeline_parallel_size=1, data_parallel_size=1, disable_custom_all_reduce=True, quantization=compressed-tensors, enforce_eager=False, kv_cache_dtype=auto, device_config=cuda, structured_outputs_config=StructuredOutputsConfig(backend='auto', disable_fallback=False, disable_any_whitespace=False, disable_additional_properties=False, reasoning_parser='', reasoning_parser_plugin='', enable_in_reasoning=False), observability_config=ObservabilityConfig(show_hidden_metrics_for_version=None, otlp_traces_endpoint=None, collect_detailed_traces=None, kv_cache_metrics=False, kv_cache_metrics_sample=0.01, cudagraph_metrics=False, enable_layerwise_nvtx_tracing=False), seed=0, served_model_name=RedHatAI/Qwen3-14B-FP8-dynamic, enable_prefix_caching=True, enable_chunked_prefill=True, pooler_config=None, compilation_config={'level': None, 'mode': <CompilationMode.VLLM_COMPILE: 3>, 'debug_dump_path': None, 'cache_dir': '', 'compile_cache_save_format': 'binary', 'backend': 'inductor', 'custom_ops': ['none'], 'splitting_ops': ['vllm::unified_attention', 'vllm::unified_attention_with_output', 'vllm::unified_mla_attention', 'vllm::unified_mla_attention_with_output', 'vllm::mamba_mixer2', 'vllm::mamba_mixer', 'vllm::short_conv', 'vllm::linear_attention', 'vllm::plamo2_mamba_mixer', 'vllm::gdn_attention_core', 'vllm::kda_attention', 'vllm::sparse_attn_indexer'], 'compile_mm_encoder': False, 'compile_sizes': [], 'compile_ranges_split_points': [2048], 'inductor_compile_config': {'enable_auto_functionalized_v2': False, 'combo_kernels': True, 'benchmark_combo_kernel': True}, 'inductor_passes': {}, 'cudagraph_mode': <CUDAGraphMode.FULL_AND_PIECEWISE: (2, 1)>, 'cudagraph_num_of_warmups': 1, 'cudagraph_capture_sizes': [1, 2, 4, 8, 16, 24, 32, 40, 48, 56, 64, 72, 80, 88, 96, 104, 112, 120, 128], 'cudagraph_copy_inputs': False, 'cudagraph_specialize_lora': True, 'use_inductor_graph_partition': False, 'pass_config': {'fuse_norm_quant': False, 'fuse_act_quant': False, 'fuse_attn_quant': False, 'eliminate_noops': True, 'enable_sp': False, 'fuse_gemm_comms': False, 'fuse_allreduce_rms': False}, 'max_cudagraph_capture_size': 128, 'dynamic_shapes_config': {'type': <DynamicShapesType.BACKED: 'backed'>, 'evaluate_guards': False}, 'local_cache_dir': None}
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:24 [parallel_state.py:1203] world_size=1 rank=0 local_rank=0 distributed_init_method=tcp://192.168.1.122:48181 backend=nccl
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:24 [parallel_state.py:1411] rank 0 in world size 1 is assigned as DP rank 0, PP rank 0, PCP rank 0, TP rank 0, EP rank 0
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:24 [gpu_model_runner.py:3562] Starting to load model RedHatAI/Qwen3-14B-FP8-dynamic...
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:25 [rocm.py:306] Using Rocm Attention backend on V1 engine.
Loading safetensors checkpoint shards: 0% Completed | 0/4 [00:00<?, ?it/s]
Loading safetensors checkpoint shards: 25% Completed | 1/4 [00:00<00:00, 3.07it/s]
Loading safetensors checkpoint shards: 50% Completed | 2/4 [00:01<00:01, 1.11it/s]
Loading safetensors checkpoint shards: 75% Completed | 3/4 [00:03<00:01, 1.14s/it]
Loading safetensors checkpoint shards: 100% Completed | 4/4 [00:04<00:00, 1.23s/it]
Loading safetensors checkpoint shards: 100% Completed | 4/4 [00:04<00:00, 1.11s/it]
(EngineCore_DP0 pid=58913)
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:30 [default_loader.py:308] Loading weights took 4.53 seconds
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:30 [gpu_model_runner.py:3659] Model loading took 15.4180 GiB memory and 5.228343 seconds
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:36 [backends.py:634] Using cache directory: /home/kyuz0/.cache/vllm/torch_compile_cache/824e5832da/rank_0_0/backbone for vLLM's torch.compile
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:36 [backends.py:694] Dynamo bytecode transform time: 5.17 s
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:38 [backends.py:261] Cache the graph of compile range (1, 2048) for later use
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:43 [backends.py:278] Compiling a graph for compile range (1, 2048) takes 4.31 s
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:43 [monitor.py:34] torch.compile takes 9.49 s in total
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:45 [gpu_worker.py:375] Available KV cache memory: 14.82 GiB
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:45 [kv_cache_utils.py:1291] GPU KV cache size: 97,088 tokens
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:45 [kv_cache_utils.py:1296] Maximum concurrency for 32,768 tokens per request: 2.96x
Capturing CUDA graphs (mixed prefill-decode, PIECEWISE): 100%|██████████| 19/19 [00:00<00:00, 20.75it/s]
Capturing CUDA graphs (decode, FULL): 100%|██████████| 11/11 [00:00<00:00, 17.97it/s]
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:48 [gpu_model_runner.py:4610] Graph capturing finished in 2 secs, took 1.04 GiB
(EngineCore_DP0 pid=58913) INFO 12-19 14:58:48 [core.py:259] init engine (profile, create kv cache, warmup model) took 17.39 seconds
(APIServer pid=58748) INFO 12-19 14:58:49 [api_server.py:1099] Supported tasks: ['generate']
(APIServer pid=58748) WARNING 12-19 14:58:49 [model.py:1462] Default sampling parameters have been overridden by the model's Hugging Face generation config recommended from the model creator. If this is not intended, please relaunch vLLM instance with `--generation-config vllm`.
(APIServer pid=58748) INFO 12-19 14:58:49 [serving_responses.py:201] Using default chat sampling params from model: {'temperature': 0.6, 'top_k': 20, 'top_p': 0.95}
(APIServer pid=58748) INFO 12-19 14:58:49 [serving_chat.py:137] Using default chat sampling params from model: {'temperature': 0.6, 'top_k': 20, 'top_p': 0.95}
(APIServer pid=58748) INFO 12-19 14:58:50 [serving_completion.py:77] Using default completion sampling params from model: {'temperature': 0.6, 'top_k': 20, 'top_p': 0.95}
(APIServer pid=58748) INFO 12-19 14:58:50 [serving_chat.py:137] Using default chat sampling params from model: {'temperature': 0.6, 'top_k': 20, 'top_p': 0.95}
(APIServer pid=58748) INFO 12-19 14:58:50 [api_server.py:1425] Starting vLLM API server 0 on http://127.0.0.1:8000
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:38] Available routes are:
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /openapi.json, Methods: GET, HEAD
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /docs, Methods: GET, HEAD
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /docs/oauth2-redirect, Methods: GET, HEAD
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /redoc, Methods: GET, HEAD
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /scale_elastic_ep, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /is_scaling_elastic_ep, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /tokenize, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /detokenize, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /inference/v1/generate, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /pause, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /resume, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /is_paused, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /metrics, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /health, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /load, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/models, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /version, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/responses, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/responses/{response_id}, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/responses/{response_id}/cancel, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/messages, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/chat/completions, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/completions, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/audio/transcriptions, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/audio/translations, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /ping, Methods: GET
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /ping, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /invocations, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /classify, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/embeddings, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /score, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/score, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /rerank, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v1/rerank, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /v2/rerank, Methods: POST
(APIServer pid=58748) INFO 12-19 14:58:50 [launcher.py:46] Route: /pooling, Methods: POST
(APIServer pid=58748) INFO: Started server process [58748]
(APIServer pid=58748) INFO: Waiting for application startup.
(APIServer pid=58748) INFO: Application startup complete.
(APIServer pid=58748) INFO: 127.0.0.1:41284 - "GET /v1/models HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43854 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 14:59:10 [loggers.py:248] Engine 000: Avg prompt throughput: 7.4 tokens/s, Avg generation throughput: 22.3 tokens/s, Running: 3 reqs, Waiting: 0 reqs, GPU KV cache usage: 0.2%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 14:59:20 [loggers.py:248] Engine 000: Avg prompt throughput: 131.2 tokens/s, Avg generation throughput: 114.0 tokens/s, Running: 4 reqs, Waiting: 0 reqs, GPU KV cache usage: 0.9%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43854 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:46026 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:46026 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 14:59:30 [loggers.py:248] Engine 000: Avg prompt throughput: 224.6 tokens/s, Avg generation throughput: 163.7 tokens/s, Running: 8 reqs, Waiting: 0 reqs, GPU KV cache usage: 2.8%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43854 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 14:59:40 [loggers.py:248] Engine 000: Avg prompt throughput: 279.4 tokens/s, Avg generation throughput: 209.9 tokens/s, Running: 9 reqs, Waiting: 0 reqs, GPU KV cache usage: 4.6%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 14:59:50 [loggers.py:248] Engine 000: Avg prompt throughput: 217.3 tokens/s, Avg generation throughput: 175.6 tokens/s, Running: 9 reqs, Waiting: 0 reqs, GPU KV cache usage: 3.6%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43854 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45826 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:46026 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43854 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:00:00 [loggers.py:248] Engine 000: Avg prompt throughput: 375.3 tokens/s, Avg generation throughput: 211.1 tokens/s, Running: 10 reqs, Waiting: 0 reqs, GPU KV cache usage: 3.8%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45828 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45826 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43854 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45826 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:00:10 [loggers.py:248] Engine 000: Avg prompt throughput: 405.3 tokens/s, Avg generation throughput: 229.8 tokens/s, Running: 11 reqs, Waiting: 0 reqs, GPU KV cache usage: 4.2%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45828 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45826 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:00:20 [loggers.py:248] Engine 000: Avg prompt throughput: 215.3 tokens/s, Avg generation throughput: 206.3 tokens/s, Running: 6 reqs, Waiting: 0 reqs, GPU KV cache usage: 3.7%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45828 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60990 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60998 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50760 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:00:30 [loggers.py:248] Engine 000: Avg prompt throughput: 298.4 tokens/s, Avg generation throughput: 214.2 tokens/s, Running: 12 reqs, Waiting: 0 reqs, GPU KV cache usage: 3.9%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60998 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50776 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47046 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60990 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60990 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:00:40 [loggers.py:248] Engine 000: Avg prompt throughput: 301.7 tokens/s, Avg generation throughput: 287.0 tokens/s, Running: 15 reqs, Waiting: 0 reqs, GPU KV cache usage: 5.7%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:60990 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60990 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60990 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:00:50 [loggers.py:248] Engine 000: Avg prompt throughput: 156.0 tokens/s, Avg generation throughput: 311.6 tokens/s, Running: 12 reqs, Waiting: 0 reqs, GPU KV cache usage: 5.3%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50760 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50776 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50760 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45828 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:01:00 [loggers.py:248] Engine 000: Avg prompt throughput: 41.1 tokens/s, Avg generation throughput: 249.5 tokens/s, Running: 8 reqs, Waiting: 0 reqs, GPU KV cache usage: 2.3%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43880 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50760 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:01:10 [loggers.py:248] Engine 000: Avg prompt throughput: 232.2 tokens/s, Avg generation throughput: 195.4 tokens/s, Running: 9 reqs, Waiting: 0 reqs, GPU KV cache usage: 3.6%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42624 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42630 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42642 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42630 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45828 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43848 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42624 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:01:20 [loggers.py:248] Engine 000: Avg prompt throughput: 219.2 tokens/s, Avg generation throughput: 243.5 tokens/s, Running: 9 reqs, Waiting: 0 reqs, GPU KV cache usage: 2.9%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:54678 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42630 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:57842 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:01:30 [loggers.py:248] Engine 000: Avg prompt throughput: 152.8 tokens/s, Avg generation throughput: 244.1 tokens/s, Running: 8 reqs, Waiting: 0 reqs, GPU KV cache usage: 2.8%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:32768 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42624 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42630 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:01:40 [loggers.py:248] Engine 000: Avg prompt throughput: 70.6 tokens/s, Avg generation throughput: 153.3 tokens/s, Running: 5 reqs, Waiting: 0 reqs, GPU KV cache usage: 3.0%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:57840 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50760 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33654 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42642 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45828 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47332 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47338 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47358 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:45828 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:01:50 [loggers.py:248] Engine 000: Avg prompt throughput: 172.9 tokens/s, Avg generation throughput: 174.6 tokens/s, Running: 9 reqs, Waiting: 0 reqs, GPU KV cache usage: 2.5%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:43866 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47358 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47338 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33208 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47338 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:47358 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50760 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:02:00 [loggers.py:248] Engine 000: Avg prompt throughput: 130.7 tokens/s, Avg generation throughput: 178.8 tokens/s, Running: 9 reqs, Waiting: 0 reqs, GPU KV cache usage: 3.6%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:33220 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33222 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50760 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33226 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33226 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42630 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42630 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:42630 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:33208 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37980 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:02:10 [loggers.py:248] Engine 000: Avg prompt throughput: 205.6 tokens/s, Avg generation throughput: 257.8 tokens/s, Running: 9 reqs, Waiting: 0 reqs, GPU KV cache usage: 4.1%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO 12-19 15:02:20 [loggers.py:248] Engine 000: Avg prompt throughput: 0.0 tokens/s, Avg generation throughput: 150.2 tokens/s, Running: 4 reqs, Waiting: 0 reqs, GPU KV cache usage: 2.8%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO 12-19 15:02:30 [loggers.py:248] Engine 000: Avg prompt throughput: 0.0 tokens/s, Avg generation throughput: 48.8 tokens/s, Running: 0 reqs, Waiting: 0 reqs, GPU KV cache usage: 0.0%, Prefix cache hit rate: 0.0%
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50742 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:02:40 [loggers.py:248] Engine 000: Avg prompt throughput: 116.7 tokens/s, Avg generation throughput: 32.7 tokens/s, Running: 7 reqs, Waiting: 0 reqs, GPU KV cache usage: 1.0%, Prefix cache hit rate: 2.8%
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50820 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50844 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50742 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:02:50 [loggers.py:248] Engine 000: Avg prompt throughput: 872.1 tokens/s, Avg generation throughput: 362.0 tokens/s, Running: 23 reqs, Waiting: 0 reqs, GPU KV cache usage: 6.9%, Prefix cache hit rate: 19.7%
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60710 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50844 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50820 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50844 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60710 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50844 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52246 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50742 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:03:00 [loggers.py:248] Engine 000: Avg prompt throughput: 1193.2 tokens/s, Avg generation throughput: 704.1 tokens/s, Running: 39 reqs, Waiting: 0 reqs, GPU KV cache usage: 14.6%, Prefix cache hit rate: 34.9%
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60710 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51306 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51312 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50844 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:03:10 [loggers.py:248] Engine 000: Avg prompt throughput: 863.9 tokens/s, Avg generation throughput: 801.8 tokens/s, Running: 46 reqs, Waiting: 0 reqs, GPU KV cache usage: 17.4%, Prefix cache hit rate: 42.5%
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51306 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51362 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52246 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:03:20 [loggers.py:248] Engine 000: Avg prompt throughput: 465.3 tokens/s, Avg generation throughput: 907.6 tokens/s, Running: 44 reqs, Waiting: 0 reqs, GPU KV cache usage: 17.7%, Prefix cache hit rate: 45.9%
(APIServer pid=58748) INFO: 127.0.0.1:51362 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50742 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52246 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51362 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51362 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50844 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:03:30 [loggers.py:248] Engine 000: Avg prompt throughput: 902.6 tokens/s, Avg generation throughput: 804.9 tokens/s, Running: 44 reqs, Waiting: 0 reqs, GPU KV cache usage: 19.0%, Prefix cache hit rate: 44.6%
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37584 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50820 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51306 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50820 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:03:40 [loggers.py:248] Engine 000: Avg prompt throughput: 1066.5 tokens/s, Avg generation throughput: 823.5 tokens/s, Running: 56 reqs, Waiting: 0 reqs, GPU KV cache usage: 21.8%, Prefix cache hit rate: 39.5%
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50832 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52246 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50742 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50832 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:03:50 [loggers.py:248] Engine 000: Avg prompt throughput: 615.9 tokens/s, Avg generation throughput: 907.6 tokens/s, Running: 50 reqs, Waiting: 0 reqs, GPU KV cache usage: 19.7%, Prefix cache hit rate: 37.1%
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52246 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50844 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60710 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50846 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51312 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51312 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60710 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37584 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38242 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38252 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38254 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:04:00 [loggers.py:248] Engine 000: Avg prompt throughput: 820.7 tokens/s, Avg generation throughput: 871.6 tokens/s, Running: 62 reqs, Waiting: 0 reqs, GPU KV cache usage: 18.3%, Prefix cache hit rate: 34.2%
(APIServer pid=58748) INFO: 127.0.0.1:38270 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38284 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38242 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38294 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38302 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38284 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38308 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38242 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51362 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38302 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50820 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38308 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38284 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38294 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50742 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60668 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38284 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38302 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50742 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38284 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51306 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52238 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:04:10 [loggers.py:248] Engine 000: Avg prompt throughput: 713.4 tokens/s, Avg generation throughput: 1065.9 tokens/s, Running: 61 reqs, Waiting: 0 reqs, GPU KV cache usage: 19.8%, Prefix cache hit rate: 32.1%
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50832 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38302 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50820 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52260 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52246 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50832 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38302 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52246 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51362 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:04:20 [loggers.py:248] Engine 000: Avg prompt throughput: 894.7 tokens/s, Avg generation throughput: 917.3 tokens/s, Running: 60 reqs, Waiting: 0 reqs, GPU KV cache usage: 20.2%, Prefix cache hit rate: 29.8%
(APIServer pid=58748) INFO: 127.0.0.1:37584 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38252 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51362 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38294 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38284 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60700 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60664 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38270 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:04:30 [loggers.py:248] Engine 000: Avg prompt throughput: 916.1 tokens/s, Avg generation throughput: 792.1 tokens/s, Running: 38 reqs, Waiting: 0 reqs, GPU KV cache usage: 15.6%, Prefix cache hit rate: 27.7%
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38254 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38302 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60710 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:04:40 [loggers.py:248] Engine 000: Avg prompt throughput: 364.6 tokens/s, Avg generation throughput: 790.1 tokens/s, Running: 32 reqs, Waiting: 0 reqs, GPU KV cache usage: 11.6%, Prefix cache hit rate: 27.0%
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51312 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38294 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38270 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38308 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38254 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50754 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:04:50 [loggers.py:248] Engine 000: Avg prompt throughput: 837.6 tokens/s, Avg generation throughput: 751.2 tokens/s, Running: 48 reqs, Waiting: 0 reqs, GPU KV cache usage: 14.6%, Prefix cache hit rate: 25.6%
(APIServer pid=58748) INFO: 127.0.0.1:51306 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43348 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43352 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43358 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43374 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51312 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43352 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38270 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38308 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60716 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43352 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60778 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43348 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38308 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43374 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51312 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43348 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:05:00 [loggers.py:248] Engine 000: Avg prompt throughput: 1054.8 tokens/s, Avg generation throughput: 785.9 tokens/s, Running: 37 reqs, Waiting: 0 reqs, GPU KV cache usage: 13.6%, Prefix cache hit rate: 23.8%
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38308 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38254 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50784 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43358 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38302 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51306 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43348 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38294 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51344 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:05:10 [loggers.py:248] Engine 000: Avg prompt throughput: 585.7 tokens/s, Avg generation throughput: 731.1 tokens/s, Running: 39 reqs, Waiting: 0 reqs, GPU KV cache usage: 13.1%, Prefix cache hit rate: 23.0%
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60724 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60762 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43358 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60750 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50818 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38308 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37566 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51312 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60696 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50864 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60734 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60744 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51372 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50794 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38254 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50814 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:43374 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:34282 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51324 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO 12-19 15:05:20 [loggers.py:248] Engine 000: Avg prompt throughput: 740.6 tokens/s, Avg generation throughput: 771.9 tokens/s, Running: 44 reqs, Waiting: 0 reqs, GPU KV cache usage: 15.0%, Prefix cache hit rate: 22.0%
(APIServer pid=58748) INFO: 127.0.0.1:38270 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50836 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60710 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50822 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50804 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38254 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50786 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:52262 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60796 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50798 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51306 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51316 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38294 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50774 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60704 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60680 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50856 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51346 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:38294 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51360 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60690 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60792 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:50806 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:60788 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:51330 - "POST /v1/completions HTTP/1.1" 200 OK
(APIServer pid=58748) INFO: 127.0.0.1:37570 - "POST /v1/completions HTTP/1.1" 200 OK
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [dump_input.py:72] Dumping input data for V1 LLM engine (v0.13.0rc2.dev112+g763963aa7.d20251213) with config: model='RedHatAI/Qwen3-14B-FP8-dynamic', speculative_config=None, tokenizer='RedHatAI/Qwen3-14B-FP8-dynamic', skip_tokenizer_init=False, tokenizer_mode=auto, revision=None, tokenizer_revision=None, trust_remote_code=True, dtype=torch.bfloat16, max_seq_len=32768, download_dir=None, load_format=auto, tensor_parallel_size=1, pipeline_parallel_size=1, data_parallel_size=1, disable_custom_all_reduce=True, quantization=compressed-tensors, enforce_eager=False, kv_cache_dtype=auto, device_config=cuda, structured_outputs_config=StructuredOutputsConfig(backend='auto', disable_fallback=False, disable_any_whitespace=False, disable_additional_properties=False, reasoning_parser='', reasoning_parser_plugin='', enable_in_reasoning=False), observability_config=ObservabilityConfig(show_hidden_metrics_for_version=None, otlp_traces_endpoint=None, collect_detailed_traces=None, kv_cache_metrics=False, kv_cache_metrics_sample=0.01, cudagraph_metrics=False, enable_layerwise_nvtx_tracing=False), seed=0, served_model_name=RedHatAI/Qwen3-14B-FP8-dynamic, enable_prefix_caching=True, enable_chunked_prefill=True, pooler_config=None, compilation_config={'level': None, 'mode': <CompilationMode.VLLM_COMPILE: 3>, 'debug_dump_path': None, 'cache_dir': '/home/kyuz0/.cache/vllm/torch_compile_cache/824e5832da', 'compile_cache_save_format': 'binary', 'backend': 'inductor', 'custom_ops': ['none'], 'splitting_ops': ['vllm::unified_attention', 'vllm::unified_attention_with_output', 'vllm::unified_mla_attention', 'vllm::unified_mla_attention_with_output', 'vllm::mamba_mixer2', 'vllm::mamba_mixer', 'vllm::short_conv', 'vllm::linear_attention', 'vllm::plamo2_mamba_mixer', 'vllm::gdn_attention_core', 'vllm::kda_attention', 'vllm::sparse_attn_indexer'], 'compile_mm_encoder': False, 'compile_sizes': [], 'compile_ranges_split_points': [2048], 'inductor_compile_config': {'enable_auto_functionalized_v2': False, 'combo_kernels': True, 'benchmark_combo_kernel': True}, 'inductor_passes': {}, 'cudagraph_mode': <CUDAGraphMode.FULL_AND_PIECEWISE: (2, 1)>, 'cudagraph_num_of_warmups': 1, 'cudagraph_capture_sizes': [1, 2, 4, 8, 16, 24, 32, 40, 48, 56, 64, 72, 80, 88, 96, 104, 112, 120, 128], 'cudagraph_copy_inputs': False, 'cudagraph_specialize_lora': True, 'use_inductor_graph_partition': False, 'pass_config': {'fuse_norm_quant': False, 'fuse_act_quant': False, 'fuse_attn_quant': False, 'eliminate_noops': True, 'enable_sp': False, 'fuse_gemm_comms': False, 'fuse_allreduce_rms': False}, 'max_cudagraph_capture_size': 128, 'dynamic_shapes_config': {'type': <DynamicShapesType.BACKED: 'backed'>, 'evaluate_guards': False}, 'local_cache_dir': '/home/kyuz0/.cache/vllm/torch_compile_cache/824e5832da/rank_0_0/backbone'},
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [dump_input.py:79] Dumping scheduler output for model execution: SchedulerOutput(scheduled_new_reqs=[NewRequestData(req_id=cmpl-bench-959ca2a7-668-0,prompt_token_ids_len=597,mm_features=[],sampling_params=SamplingParams(n=1, presence_penalty=0.0, frequency_penalty=0.0, repetition_penalty=1.0, temperature=0.0, top_p=1.0, top_k=0, min_p=0.0, seed=None, stop=[], stop_token_ids=[151643], bad_words=[], include_stop_str_in_output=False, ignore_eos=False, max_tokens=11, min_tokens=0, logprobs=None, prompt_logprobs=None, skip_special_tokens=True, spaces_between_special_tokens=True, truncate_prompt_tokens=None, structured_outputs=None, extra_args=None),block_ids=([2457, 311, 4955, 4403, 501, 1834, 3391, 1462, 679, 1386, 2343, 978, 2420, 2359, 2291, 1348, 611, 4569, 4357, 1443, 2301, 4246, 3135, 4341, 5307, 1176, 1744, 4249, 2188, 1792, 1334, 4950, 562, 5082, 127, 4989, 4837, 4530],),num_computed_tokens=0,lora_request=None,prompt_embeds_shape=None)], scheduled_cached_reqs=CachedRequestData(req_ids=['cmpl-bench-959ca2a7-518-0', 'cmpl-bench-959ca2a7-553-0', 'cmpl-bench-959ca2a7-573-0', 'cmpl-bench-959ca2a7-582-0', 'cmpl-bench-959ca2a7-586-0', 'cmpl-bench-959ca2a7-596-0', 'cmpl-bench-959ca2a7-602-0', 'cmpl-bench-959ca2a7-606-0', 'cmpl-bench-959ca2a7-607-0', 'cmpl-bench-959ca2a7-608-0', 'cmpl-bench-959ca2a7-609-0', 'cmpl-bench-959ca2a7-613-0', 'cmpl-bench-959ca2a7-617-0', 'cmpl-bench-959ca2a7-619-0', 'cmpl-bench-959ca2a7-622-0', 'cmpl-bench-959ca2a7-624-0', 'cmpl-bench-959ca2a7-625-0', 'cmpl-bench-959ca2a7-626-0', 'cmpl-bench-959ca2a7-627-0', 'cmpl-bench-959ca2a7-628-0', 'cmpl-bench-959ca2a7-630-0', 'cmpl-bench-959ca2a7-631-0', 'cmpl-bench-959ca2a7-632-0', 'cmpl-bench-959ca2a7-633-0', 'cmpl-bench-959ca2a7-634-0', 'cmpl-bench-959ca2a7-635-0', 'cmpl-bench-959ca2a7-636-0', 'cmpl-bench-959ca2a7-637-0', 'cmpl-bench-959ca2a7-638-0', 'cmpl-bench-959ca2a7-639-0', 'cmpl-bench-959ca2a7-640-0', 'cmpl-bench-959ca2a7-641-0', 'cmpl-bench-959ca2a7-642-0', 'cmpl-bench-959ca2a7-643-0', 'cmpl-bench-959ca2a7-648-0', 'cmpl-bench-959ca2a7-649-0', 'cmpl-bench-959ca2a7-650-0', 'cmpl-bench-959ca2a7-655-0', 'cmpl-bench-959ca2a7-656-0', 'cmpl-bench-959ca2a7-658-0', 'cmpl-bench-959ca2a7-659-0', 'cmpl-bench-959ca2a7-660-0', 'cmpl-bench-959ca2a7-661-0', 'cmpl-bench-959ca2a7-662-0', 'cmpl-bench-959ca2a7-663-0', 'cmpl-bench-959ca2a7-664-0', 'cmpl-bench-959ca2a7-665-0', 'cmpl-bench-959ca2a7-666-0', 'cmpl-bench-959ca2a7-667-0'], resumed_req_ids=[], new_token_ids=[], all_token_ids={}, new_block_ids=[null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, null, [[585]], null, null, null, null, null, [[1203]], null, null, null, null, null, [[4226]], null, null, null, null, [[5315]], null, null, null, null, null, null, null, null], num_computed_tokens=[743, 623, 1340, 663, 450, 395, 767, 317, 374, 461, 386, 385, 486, 541, 231, 211, 856, 191, 183, 185, 204, 191, 242, 224, 166, 168, 173, 157, 951, 352, 143, 121, 230, 115, 193, 80, 129, 58, 175, 52, 32, 104, 25, 25, 781, 533, 22, 622, 583], num_output_tokens=[738, 606, 483, 434, 426, 353, 318, 312, 311, 307, 305, 285, 277, 238, 227, 198, 186, 181, 175, 173, 172, 171, 171, 167, 159, 143, 142, 142, 137, 133, 124, 110, 89, 86, 65, 65, 61, 49, 48, 45, 25, 23, 12, 12, 10, 9, 8, 4, 3]), num_scheduled_tokens={cmpl-bench-959ca2a7-613-0: 1, cmpl-bench-959ca2a7-602-0: 1, cmpl-bench-959ca2a7-622-0: 1, cmpl-bench-959ca2a7-518-0: 1, cmpl-bench-959ca2a7-617-0: 1, cmpl-bench-959ca2a7-655-0: 1, cmpl-bench-959ca2a7-643-0: 1, cmpl-bench-959ca2a7-663-0: 1, cmpl-bench-959ca2a7-596-0: 1, cmpl-bench-959ca2a7-637-0: 1, cmpl-bench-959ca2a7-631-0: 1, cmpl-bench-959ca2a7-638-0: 1, cmpl-bench-959ca2a7-573-0: 1, cmpl-bench-959ca2a7-642-0: 1, cmpl-bench-959ca2a7-619-0: 1, cmpl-bench-959ca2a7-607-0: 1, cmpl-bench-959ca2a7-658-0: 1, cmpl-bench-959ca2a7-635-0: 1, cmpl-bench-959ca2a7-632-0: 1, cmpl-bench-959ca2a7-634-0: 1, cmpl-bench-959ca2a7-633-0: 1, cmpl-bench-959ca2a7-662-0: 1, cmpl-bench-959ca2a7-659-0: 1, cmpl-bench-959ca2a7-630-0: 1, cmpl-bench-959ca2a7-624-0: 1, cmpl-bench-959ca2a7-628-0: 1, cmpl-bench-959ca2a7-667-0: 1, cmpl-bench-959ca2a7-606-0: 1, cmpl-bench-959ca2a7-626-0: 1, cmpl-bench-959ca2a7-553-0: 1, cmpl-bench-959ca2a7-608-0: 1, cmpl-bench-959ca2a7-661-0: 1, cmpl-bench-959ca2a7-664-0: 1, cmpl-bench-959ca2a7-627-0: 1, cmpl-bench-959ca2a7-641-0: 1, cmpl-bench-959ca2a7-649-0: 1, cmpl-bench-959ca2a7-656-0: 1, cmpl-bench-959ca2a7-636-0: 1, cmpl-bench-959ca2a7-625-0: 1, cmpl-bench-959ca2a7-639-0: 1, cmpl-bench-959ca2a7-648-0: 1, cmpl-bench-959ca2a7-666-0: 1, cmpl-bench-959ca2a7-609-0: 1, cmpl-bench-959ca2a7-665-0: 1, cmpl-bench-959ca2a7-668-0: 597, cmpl-bench-959ca2a7-660-0: 1, cmpl-bench-959ca2a7-640-0: 1, cmpl-bench-959ca2a7-586-0: 1, cmpl-bench-959ca2a7-650-0: 1, cmpl-bench-959ca2a7-582-0: 1}, total_num_scheduled_tokens=646, scheduled_spec_decode_tokens={}, scheduled_encoder_inputs={}, num_common_prefix_blocks=[0], finished_req_ids=[], free_encoder_mm_hashes=[], preempted_req_ids=[], pending_structured_output_tokens=false, kv_connector_metadata=null, ec_connector_metadata=null)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [dump_input.py:81] Dumping scheduler stats: SchedulerStats(num_running_reqs=50, num_waiting_reqs=0, step_counter=0, current_wave=0, kv_cache_usage=0.181803197626504, prefix_cache_stats=PrefixCacheStats(reset=False, requests=1, queries=597, hits=0, preempted_requests=0, preempted_queries=0, preempted_hits=0), connector_prefix_cache_stats=None, kv_cache_eviction_events=[], spec_decoding_stats=None, kv_connector_stats=None, waiting_lora_adapters={}, running_lora_adapters={}, cudagraph_stats=None)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] EngineCore encountered a fatal error.
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] Traceback (most recent call last):
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 859, in run_engine_core
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] engine_core.run_busy_loop()
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ~~~~~~~~~~~~~~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 886, in run_busy_loop
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] self._process_engine_step()
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ~~~~~~~~~~~~~~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 919, in _process_engine_step
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] outputs, model_executed = self.step_fn()
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 353, in step
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] model_output = self.model_executor.sample_tokens(grammar_output)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/uniproc_executor.py", line 110, in sample_tokens
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] return self.collective_rpc(
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ~~~~~~~~~~~~~~~~~~~^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] "sample_tokens",
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ...<2 lines>...
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] single_value=True,
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ^^^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] )
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/uniproc_executor.py", line 75, in collective_rpc
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] result = run_method(self.driver_worker, method, args, kwargs)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/serial_utils.py", line 461, in run_method
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] return func(*args, **kwargs)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/torch/utils/_contextlib.py", line 124, in decorate_context
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] return func(*args, **kwargs)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_worker.py", line 572, in sample_tokens
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] return self.model_runner.sample_tokens(grammar_output)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/torch/utils/_contextlib.py", line 124, in decorate_context
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] return func(*args, **kwargs)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 3281, in sample_tokens
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ) = self._bookkeeping_sync(
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ~~~~~~~~~~~~~~~~~~~~~~^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] scheduler_output,
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ^^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ...<4 lines>...
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] spec_decode_metadata,
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ^^^^^^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] )
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 2625, in _bookkeeping_sync
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] valid_sampled_token_ids = self._to_list(sampled_token_ids)
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 5492, in _to_list
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] self.transfer_event.synchronize()
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] torch.AcceleratorError: HIP error: an illegal memory access was encountered
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] Search for `hipErrorIllegalAddress' in https://rocm.docs.amd.com/projects/HIP/en/latest/index.html for more information.
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] HIP kernel errors might be asynchronously reported at some other API call, so the stacktrace below might be incorrect.
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] For debugging consider passing AMD_SERIALIZE_KERNEL=3
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868] Compile with `TORCH_USE_HIP_DSA` to enable device-side assertions.
(EngineCore_DP0 pid=58913) ERROR 12-19 15:05:29 [core.py:868]
(EngineCore_DP0 pid=58913) Process EngineCore_DP0:
(EngineCore_DP0 pid=58913) Traceback (most recent call last):
(EngineCore_DP0 pid=58913) File "/usr/lib64/python3.13/multiprocessing/process.py", line 313, in _bootstrap
(EngineCore_DP0 pid=58913) self.run()
(EngineCore_DP0 pid=58913) ~~~~~~~~^^
(EngineCore_DP0 pid=58913) File "/usr/lib64/python3.13/multiprocessing/process.py", line 108, in run
(EngineCore_DP0 pid=58913) self._target(*self._args, **self._kwargs)
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 870, in run_engine_core
(EngineCore_DP0 pid=58913) raise e
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 859, in run_engine_core
(EngineCore_DP0 pid=58913) engine_core.run_busy_loop()
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~~~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 886, in run_busy_loop
(EngineCore_DP0 pid=58913) self._process_engine_step()
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~~~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 919, in _process_engine_step
(EngineCore_DP0 pid=58913) outputs, model_executed = self.step_fn()
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 353, in step
(EngineCore_DP0 pid=58913) model_output = self.model_executor.sample_tokens(grammar_output)
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/uniproc_executor.py", line 110, in sample_tokens
(EngineCore_DP0 pid=58913) return self.collective_rpc(
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~~~~~~~~^
(EngineCore_DP0 pid=58913) "sample_tokens",
(EngineCore_DP0 pid=58913) ^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) ...<2 lines>...
(EngineCore_DP0 pid=58913) single_value=True,
(EngineCore_DP0 pid=58913) ^^^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) )
(EngineCore_DP0 pid=58913) ^
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/uniproc_executor.py", line 75, in collective_rpc
(EngineCore_DP0 pid=58913) result = run_method(self.driver_worker, method, args, kwargs)
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/serial_utils.py", line 461, in run_method
(EngineCore_DP0 pid=58913) return func(*args, **kwargs)
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/torch/utils/_contextlib.py", line 124, in decorate_context
(EngineCore_DP0 pid=58913) return func(*args, **kwargs)
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_worker.py", line 572, in sample_tokens
(EngineCore_DP0 pid=58913) return self.model_runner.sample_tokens(grammar_output)
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/torch/utils/_contextlib.py", line 124, in decorate_context
(EngineCore_DP0 pid=58913) return func(*args, **kwargs)
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 3281, in sample_tokens
(EngineCore_DP0 pid=58913) ) = self._bookkeeping_sync(
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~~~~~~~~~~~^
(EngineCore_DP0 pid=58913) scheduler_output,
(EngineCore_DP0 pid=58913) ^^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) ...<4 lines>...
(EngineCore_DP0 pid=58913) spec_decode_metadata,
(EngineCore_DP0 pid=58913) ^^^^^^^^^^^^^^^^^^^^^
(EngineCore_DP0 pid=58913) )
(EngineCore_DP0 pid=58913) ^
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 2625, in _bookkeeping_sync
(EngineCore_DP0 pid=58913) valid_sampled_token_ids = self._to_list(sampled_token_ids)
(EngineCore_DP0 pid=58913) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 5492, in _to_list
(EngineCore_DP0 pid=58913) self.transfer_event.synchronize()
(EngineCore_DP0 pid=58913) ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~^^
(EngineCore_DP0 pid=58913) torch.AcceleratorError: HIP error: an illegal memory access was encountered
(EngineCore_DP0 pid=58913) Search for `hipErrorIllegalAddress' in https://rocm.docs.amd.com/projects/HIP/en/latest/index.html for more information.
(EngineCore_DP0 pid=58913) HIP kernel errors might be asynchronously reported at some other API call, so the stacktrace below might be incorrect.
(EngineCore_DP0 pid=58913) For debugging consider passing AMD_SERIALIZE_KERNEL=3
(EngineCore_DP0 pid=58913) Compile with `TORCH_USE_HIP_DSA` to enable device-side assertions.
(EngineCore_DP0 pid=58913)
[rank0]:[W1219 15:05:29.875861010 ProcessGroupNCCL.cpp:1553] Warning: WARNING: destroy_process_group() was not called before program exit, which can leak resources. For more info, please see https://pytorch.org/docs/stable/distributed.html#shutdown (function operator())
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] AsyncLLM output_handler failed.
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [async_llm.py:538] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
hipModuleUnload failed:
error: an illegal memory access was encountered
hipModuleUnload failed:
error: an illegal memory access was encountered
hipModuleUnload failed:
error: an illegal memory access was encountered
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:29 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] Error in completion stream generator.
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] Traceback (most recent call last):
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for prompt_idx, res in result_generator:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ...<125 lines>...
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield f"data: {response_json}\n\n"
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] async for item in iterators[0]:
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] yield 0, item
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] out = q.get_nowait() or await q.get()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise output
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] outputs = await engine_core.get_output_async()
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] raise self._format_exception(outputs) from None
(APIServer pid=58748) ERROR 12-19 15:05:30 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause.
(APIServer pid=58748) INFO: 127.0.0.1:50762 - "POST /v1/completions HTTP/1.1" 500 Internal Server Error
(APIServer pid=58748) INFO: 127.0.0.1:52514 - "POST /v1/completions HTTP/1.1" 500 Internal Server Error
(APIServer pid=58748) INFO: 127.0.0.1:52528 - "POST /v1/completions HTTP/1.1" 500 Internal Server Error
(APIServer pid=58748) INFO: Shutting down
(APIServer pid=58748) INFO: Waiting for application shutdown.
(APIServer pid=58748) INFO: Application shutdown complete.
(APIServer pid=58748) INFO: Finished server process [58748]