Skipping import of cpp extensions due to incompatible torch version 2.10.0a0+rocm7.11.0a20251210 for torchao version 0.14.1 Please see https://github.com/pytorch/ao/issues/2919 for more info WARNING 12-19 17:35:32 [attention.py:82] Using VLLM_V1_USE_PREFILL_DECODE_ATTENTION environment variable is deprecated and will be removed in v0.14.0 or v1.0.0, whichever is soonest. Please use --attention-config.use_prefill_decode_attention command line argument or AttentionConfig(use_prefill_decode_attention=...) config field instead. (APIServer pid=77686) INFO 12-19 17:35:32 [api_server.py:1351] vLLM API server version 0.13.0rc2.dev112+g763963aa7.d20251213 (APIServer pid=77686) INFO 12-19 17:35:32 [utils.py:253] non-default args: {'model_tag': 'RedHatAI/gemma-3-27b-it-FP8-dynamic', 'host': '127.0.0.1', 'model': 'RedHatAI/gemma-3-27b-it-FP8-dynamic', 'trust_remote_code': True, 'max_model_len': 28900, 'tensor_parallel_size': 2, 'gpu_memory_utilization': 0.94, 'max_num_seqs': 32} (APIServer pid=77686) The argument `trust_remote_code` is to be used with Auto classes. It has no effect here and is ignored. (APIServer pid=77686) INFO 12-19 17:35:36 [model.py:514] Resolved architecture: Gemma3ForConditionalGeneration (APIServer pid=77686) INFO 12-19 17:35:36 [model.py:1636] Using max model len 28900 (APIServer pid=77686) INFO 12-19 17:35:36 [scheduler.py:228] Chunked prefill is enabled with max_num_batched_tokens=2048. Skipping import of cpp extensions due to incompatible torch version 2.10.0a0+rocm7.11.0a20251210 for torchao version 0.14.1 Please see https://github.com/pytorch/ao/issues/2919 for more info (EngineCore_DP0 pid=77851) INFO 12-19 17:35:41 [core.py:93] Initializing a V1 LLM engine (v0.13.0rc2.dev112+g763963aa7.d20251213) with config: model='RedHatAI/gemma-3-27b-it-FP8-dynamic', speculative_config=None, tokenizer='RedHatAI/gemma-3-27b-it-FP8-dynamic', skip_tokenizer_init=False, tokenizer_mode=auto, revision=None, tokenizer_revision=None, trust_remote_code=True, dtype=torch.bfloat16, max_seq_len=28900, download_dir=None, load_format=auto, tensor_parallel_size=2, pipeline_parallel_size=1, data_parallel_size=1, disable_custom_all_reduce=True, quantization=compressed-tensors, enforce_eager=False, kv_cache_dtype=auto, device_config=cuda, structured_outputs_config=StructuredOutputsConfig(backend='auto', disable_fallback=False, disable_any_whitespace=False, disable_additional_properties=False, reasoning_parser='', reasoning_parser_plugin='', enable_in_reasoning=False), observability_config=ObservabilityConfig(show_hidden_metrics_for_version=None, otlp_traces_endpoint=None, collect_detailed_traces=None, kv_cache_metrics=False, kv_cache_metrics_sample=0.01, cudagraph_metrics=False, enable_layerwise_nvtx_tracing=False), seed=0, served_model_name=RedHatAI/gemma-3-27b-it-FP8-dynamic, enable_prefix_caching=True, enable_chunked_prefill=True, pooler_config=None, compilation_config={'level': None, 'mode': , 'debug_dump_path': None, 'cache_dir': '', 'compile_cache_save_format': 'binary', 'backend': 'inductor', 'custom_ops': ['none'], 'splitting_ops': ['vllm::unified_attention', 'vllm::unified_attention_with_output', 'vllm::unified_mla_attention', 'vllm::unified_mla_attention_with_output', 'vllm::mamba_mixer2', 'vllm::mamba_mixer', 'vllm::short_conv', 'vllm::linear_attention', 'vllm::plamo2_mamba_mixer', 'vllm::gdn_attention_core', 'vllm::kda_attention', 'vllm::sparse_attn_indexer'], 'compile_mm_encoder': False, 'compile_sizes': [], 'compile_ranges_split_points': [2048], 'inductor_compile_config': {'enable_auto_functionalized_v2': False, 'combo_kernels': True, 'benchmark_combo_kernel': True}, 'inductor_passes': {}, 'cudagraph_mode': , 'cudagraph_num_of_warmups': 1, 'cudagraph_capture_sizes': [1, 2, 4, 8, 16, 24, 32, 40, 48, 56, 64], 'cudagraph_copy_inputs': False, 'cudagraph_specialize_lora': True, 'use_inductor_graph_partition': False, 'pass_config': {'fuse_norm_quant': False, 'fuse_act_quant': False, 'fuse_attn_quant': False, 'eliminate_noops': True, 'enable_sp': False, 'fuse_gemm_comms': False, 'fuse_allreduce_rms': False}, 'max_cudagraph_capture_size': 64, 'dynamic_shapes_config': {'type': , 'evaluate_guards': False}, 'local_cache_dir': None} (EngineCore_DP0 pid=77851) WARNING 12-19 17:35:41 [multiproc_executor.py:884] Reducing Torch parallelism from 24 threads to 1 to avoid unnecessary CPU contention. Set OMP_NUM_THREADS in the external environment to tune this value as needed. Skipping import of cpp extensions due to incompatible torch version 2.10.0a0+rocm7.11.0a20251210 for torchao version 0.14.1 Please see https://github.com/pytorch/ao/issues/2919 for more info Skipping import of cpp extensions due to incompatible torch version 2.10.0a0+rocm7.11.0a20251210 for torchao version 0.14.1 Please see https://github.com/pytorch/ao/issues/2919 for more info INFO 12-19 17:35:46 [parallel_state.py:1203] world_size=2 rank=0 local_rank=0 distributed_init_method=tcp://127.0.0.1:33879 backend=nccl INFO 12-19 17:35:46 [parallel_state.py:1203] world_size=2 rank=1 local_rank=1 distributed_init_method=tcp://127.0.0.1:33879 backend=nccl INFO 12-19 17:35:46 [pynccl.py:111] vLLM is using nccl==2.27.3 INFO 12-19 17:35:46 [parallel_state.py:1411] rank 0 in world size 2 is assigned as DP rank 0, PP rank 0, PCP rank 0, TP rank 0, EP rank 0 INFO 12-19 17:35:46 [parallel_state.py:1411] rank 1 in world size 2 is assigned as DP rank 0, PP rank 0, PCP rank 0, TP rank 1, EP rank 1 Using a slow image processor as `use_fast` is unset and a slow processor was saved with this model. `use_fast=True` will be the default behavior in v4.52, even if the model was saved with a slow processor. This will result in minor differences in outputs. You'll still be able to use a slow processor with `use_fast=False`. Using a slow image processor as `use_fast` is unset and a slow processor was saved with this model. `use_fast=True` will be the default behavior in v4.52, even if the model was saved with a slow processor. This will result in minor differences in outputs. You'll still be able to use a slow processor with `use_fast=False`. (Worker_TP0 pid=77933) INFO 12-19 17:35:52 [gpu_model_runner.py:3562] Starting to load model RedHatAI/gemma-3-27b-it-FP8-dynamic... (Worker_TP0 pid=77933) WARNING 12-19 17:35:53 [compressed_tensors.py:742] Acceleration for non-quantized schemes is not supported by Compressed Tensors. Falling back to UnquantizedLinearMethod (Worker_TP0 pid=77933) INFO 12-19 17:35:53 [layer.py:537] Using AttentionBackendEnum.TORCH_SDPA for MultiHeadAttention in multimodal encoder. (Worker_TP0 pid=77933) WARNING 12-19 17:35:53 [activation.py:544] [ROCm] PyTorch's native GELU with tanh approximation is unstable. Falling back to GELU(approximate='none'). (Worker_TP1 pid=77934) WARNING 12-19 17:35:53 [compressed_tensors.py:742] Acceleration for non-quantized schemes is not supported by Compressed Tensors. Falling back to UnquantizedLinearMethod (Worker_TP1 pid=77934) INFO 12-19 17:35:53 [layer.py:537] Using AttentionBackendEnum.TORCH_SDPA for MultiHeadAttention in multimodal encoder. (Worker_TP1 pid=77934) WARNING 12-19 17:35:53 [activation.py:544] [ROCm] PyTorch's native GELU with tanh approximation is unstable. Falling back to GELU(approximate='none'). (Worker_TP1 pid=77934) INFO 12-19 17:35:53 [rocm.py:306] Using Rocm Attention backend on V1 engine. (Worker_TP0 pid=77933) INFO 12-19 17:35:53 [rocm.py:306] Using Rocm Attention backend on V1 engine. (Worker_TP1 pid=77934) WARNING 12-19 17:35:53 [activation.py:220] [ROCm] PyTorch's native GELU with tanh approximation is unstable with torch.compile. For native implementation, fallback to 'none' approximation. The custom kernel implementation is unaffected. (Worker_TP0 pid=77933) WARNING 12-19 17:35:53 [activation.py:220] [ROCm] PyTorch's native GELU with tanh approximation is unstable with torch.compile. For native implementation, fallback to 'none' approximation. The custom kernel implementation is unaffected. (Worker_TP0 pid=77933) Loading safetensors checkpoint shards: 0% Completed | 0/6 [00:00... (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] spec_decode_metadata, (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] ^^^^^^^^^^^^^^^^^^^^^ (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] ) (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] ^ (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 2625, in _bookkeeping_sync (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] valid_sampled_token_ids = self._to_list(sampled_token_ids) (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 5492, in _to_list (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] self.transfer_event.synchronize() (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~^^ (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] torch.AcceleratorError: HIP error: an illegal memory access was encountered (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] Search for `hipErrorIllegalAddress' in https://rocm.docs.amd.com/projects/HIP/en/latest/index.html for more information. (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] HIP kernel errors might be asynchronously reported at some other API call, so the stacktrace below might be incorrect. (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] For debugging consider passing AMD_SERIALIZE_KERNEL=3 (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] Compile with `TORCH_USE_HIP_DSA` to enable device-side assertions. (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] Traceback (most recent call last): (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/multiproc_executor.py", line 821, in worker_busy_loop (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] output = func(*args, **kwargs) (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] File "/opt/venv/lib64/python3.13/site-packages/torch/utils/_contextlib.py", line 124, in decorate_context (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] return func(*args, **kwargs) (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_worker.py", line 572, in sample_tokens (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] return self.model_runner.sample_tokens(grammar_output) (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~^^^^^^^^^^^^^^^^ (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] File "/opt/venv/lib64/python3.13/site-packages/torch/utils/_contextlib.py", line 124, in decorate_context (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] return func(*args, **kwargs) (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 3281, in sample_tokens (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] ) = self._bookkeeping_sync( (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] ~~~~~~~~~~~~~~~~~~~~~~^ (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] scheduler_output, (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] ^^^^^^^^^^^^^^^^^ (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] ...<4 lines>... (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] spec_decode_metadata, (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] ^^^^^^^^^^^^^^^^^^^^^ (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] ) (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] ^ (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 2625, in _bookkeeping_sync (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] valid_sampled_token_ids = self._to_list(sampled_token_ids) (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/worker/gpu_model_runner.py", line 5492, in _to_list (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] self.transfer_event.synchronize() (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~^^ (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] torch.AcceleratorError: HIP error: an illegal memory access was encountered (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] Search for `hipErrorIllegalAddress' in https://rocm.docs.amd.com/projects/HIP/en/latest/index.html for more information. (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] HIP kernel errors might be asynchronously reported at some other API call, so the stacktrace below might be incorrect. (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] For debugging consider passing AMD_SERIALIZE_KERNEL=3 (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] Compile with `TORCH_USE_HIP_DSA` to enable device-side assertions. (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] (Worker_TP1 pid=77934) ERROR 12-19 17:38:16 [multiproc_executor.py:826] [rank1]:[E1219 17:38:16.877431190 ProcessGroupNCCL.cpp:2093] [PG ID 2 PG GUID 3 Rank 1] Process group watchdog thread terminated with exception: HIP error: an illegal memory access was encountered Search for `hipErrorIllegalAddress' in https://rocm.docs.amd.com/projects/HIP/en/latest/index.html for more information. HIP kernel errors might be asynchronously reported at some other API call, so the stacktrace below might be incorrect. For debugging consider passing AMD_SERIALIZE_KERNEL=3 Compile with `TORCH_USE_HIP_DSA` to enable device-side assertions. Exception raised from getDevice at /__w/TheRock/TheRock/external-builds/pytorch/pytorch/aten/src/ATen/hip/impl/HIPGuardImplMasqueradingAsCUDA.h:75 (most recent call first): frame #0: c10::Error::Error(c10::SourceLocation, std::__cxx11::basic_string, std::allocator >) + 0x9d (0x7f01713fafdd in /opt/venv/lib64/python3.13/site-packages/torch/lib/libc10.so) frame #1: + 0x12568 (0x7f0171486568 in /opt/venv/lib64/python3.13/site-packages/torch/lib/libc10_hip.so) frame #2: c10d::ProcessGroupNCCL::Watchdog::runLoop() + 0x922 (0x7f0174a7ccc2 in /opt/venv/lib64/python3.13/site-packages/torch/lib/libtorch_hip.so) frame #3: c10d::ProcessGroupNCCL::Watchdog::run() + 0x105 (0x7f0174a7f1b5 in /opt/venv/lib64/python3.13/site-packages/torch/lib/libtorch_hip.so) frame #4: + 0x4e3e4 (0x7f01dce603e4 in /lib64/libstdc++.so.6) frame #5: + 0x72464 (0x7f01dd0fb464 in /lib64/libc.so.6) frame #6: + 0xf55ac (0x7f01dd17e5ac in /lib64/libc.so.6) terminate called after throwing an instance of 'c10::DistBackendError' what(): [PG ID 2 PG GUID 3 Rank 1] Process group watchdog thread terminated with exception: HIP error: an illegal memory access was encountered Search for `hipErrorIllegalAddress' in https://rocm.docs.amd.com/projects/HIP/en/latest/index.html for more information. HIP kernel errors might be asynchronously reported at some other API call, so the stacktrace below might be incorrect. For debugging consider passing AMD_SERIALIZE_KERNEL=3 Compile with `TORCH_USE_HIP_DSA` to enable device-side assertions. Exception raised from getDevice at /__w/TheRock/TheRock/external-builds/pytorch/pytorch/aten/src/ATen/hip/impl/HIPGuardImplMasqueradingAsCUDA.h:75 (most recent call first): frame #0: c10::Error::Error(c10::SourceLocation, std::__cxx11::basic_string, std::allocator >) + 0x9d (0x7f01713fafdd in /opt/venv/lib64/python3.13/site-packages/torch/lib/libc10.so) frame #1: + 0x12568 (0x7f0171486568 in /opt/venv/lib64/python3.13/site-packages/torch/lib/libc10_hip.so) frame #2: c10d::ProcessGroupNCCL::Watchdog::runLoop() + 0x922 (0x7f0174a7ccc2 in /opt/venv/lib64/python3.13/site-packages/torch/lib/libtorch_hip.so) frame #3: c10d::ProcessGroupNCCL::Watchdog::run() + 0x105 (0x7f0174a7f1b5 in /opt/venv/lib64/python3.13/site-packages/torch/lib/libtorch_hip.so) frame #4: + 0x4e3e4 (0x7f01dce603e4 in /lib64/libstdc++.so.6) frame #5: + 0x72464 (0x7f01dd0fb464 in /lib64/libc.so.6) frame #6: + 0xf55ac (0x7f01dd17e5ac in /lib64/libc.so.6) Exception raised from run at /__w/TheRock/TheRock/external-builds/pytorch/pytorch/torch/csrc/distributed/c10d/ProcessGroupNCCL.cpp:2099 (most recent call first): frame #0: c10::Error::Error(c10::SourceLocation, std::__cxx11::basic_string, std::allocator >) + 0x9d (0x7f01713fafdd in /opt/venv/lib64/python3.13/site-packages/torch/lib/libc10.so) frame #1: + 0xb51c0c (0x7f0172129c0c in /opt/venv/lib64/python3.13/site-packages/torch/lib/libtorch_hip.so) frame #2: + 0x4e3e4 (0x7f01dce603e4 in /lib64/libstdc++.so.6) frame #3: + 0x72464 (0x7f01dd0fb464 in /lib64/libc.so.6) frame #4: + 0xf55ac (0x7f01dd17e5ac in /lib64/libc.so.6) (APIServer pid=77686) INFO: 127.0.0.1:60172 - "POST /v1/completions HTTP/1.1" 200 OK (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:16 [multiproc_executor.py:233] Worker proc VllmWorker-1 died unexpectedly, shutting down executor. (Worker_TP0 pid=77933) INFO 12-19 17:38:16 [multiproc_executor.py:711] Parent process exited, terminating worker (APIServer pid=77686) INFO: 127.0.0.1:59118 - "POST /v1/completions HTTP/1.1" 200 OK (APIServer pid=77686) INFO: 127.0.0.1:59124 - "POST /v1/completions HTTP/1.1" 200 OK (APIServer pid=77686) INFO: 127.0.0.1:59126 - "POST /v1/completions HTTP/1.1" 200 OK (APIServer pid=77686) INFO 12-19 17:38:18 [loggers.py:248] Engine 000: Avg prompt throughput: 172.0 tokens/s, Avg generation throughput: 150.8 tokens/s, Running: 11 reqs, Waiting: 0 reqs, GPU KV cache usage: 9.1%, Prefix cache hit rate: 0.0%, MM cache hit rate: 0.0% (APIServer pid=77686) INFO: 127.0.0.1:59134 - "POST /v1/completions HTTP/1.1" 200 OK (APIServer pid=77686) INFO: 127.0.0.1:59138 - "POST /v1/completions HTTP/1.1" 200 OK (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [dump_input.py:72] Dumping input data for V1 LLM engine (v0.13.0rc2.dev112+g763963aa7.d20251213) with config: model='RedHatAI/gemma-3-27b-it-FP8-dynamic', speculative_config=None, tokenizer='RedHatAI/gemma-3-27b-it-FP8-dynamic', skip_tokenizer_init=False, tokenizer_mode=auto, revision=None, tokenizer_revision=None, trust_remote_code=True, dtype=torch.bfloat16, max_seq_len=28900, download_dir=None, load_format=auto, tensor_parallel_size=2, pipeline_parallel_size=1, data_parallel_size=1, disable_custom_all_reduce=True, quantization=compressed-tensors, enforce_eager=False, kv_cache_dtype=auto, device_config=cuda, structured_outputs_config=StructuredOutputsConfig(backend='auto', disable_fallback=False, disable_any_whitespace=False, disable_additional_properties=False, reasoning_parser='', reasoning_parser_plugin='', enable_in_reasoning=False), observability_config=ObservabilityConfig(show_hidden_metrics_for_version=None, otlp_traces_endpoint=None, collect_detailed_traces=None, kv_cache_metrics=False, kv_cache_metrics_sample=0.01, cudagraph_metrics=False, enable_layerwise_nvtx_tracing=False), seed=0, served_model_name=RedHatAI/gemma-3-27b-it-FP8-dynamic, enable_prefix_caching=True, enable_chunked_prefill=True, pooler_config=None, compilation_config={'level': None, 'mode': , 'debug_dump_path': None, 'cache_dir': '', 'compile_cache_save_format': 'binary', 'backend': 'inductor', 'custom_ops': ['none'], 'splitting_ops': ['vllm::unified_attention', 'vllm::unified_attention_with_output', 'vllm::unified_mla_attention', 'vllm::unified_mla_attention_with_output', 'vllm::mamba_mixer2', 'vllm::mamba_mixer', 'vllm::short_conv', 'vllm::linear_attention', 'vllm::plamo2_mamba_mixer', 'vllm::gdn_attention_core', 'vllm::kda_attention', 'vllm::sparse_attn_indexer'], 'compile_mm_encoder': False, 'compile_sizes': [], 'compile_ranges_split_points': [2048], 'inductor_compile_config': {'enable_auto_functionalized_v2': False, 'combo_kernels': True, 'benchmark_combo_kernel': True}, 'inductor_passes': {}, 'cudagraph_mode': , 'cudagraph_num_of_warmups': 1, 'cudagraph_capture_sizes': [1, 2, 4, 8, 16, 24, 32, 40, 48, 56, 64], 'cudagraph_copy_inputs': False, 'cudagraph_specialize_lora': True, 'use_inductor_graph_partition': False, 'pass_config': {'fuse_norm_quant': False, 'fuse_act_quant': False, 'fuse_attn_quant': False, 'eliminate_noops': True, 'enable_sp': False, 'fuse_gemm_comms': False, 'fuse_allreduce_rms': False}, 'max_cudagraph_capture_size': 64, 'dynamic_shapes_config': {'type': , 'evaluate_guards': False}, 'local_cache_dir': None}, (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [dump_input.py:79] Dumping scheduler output for model execution: SchedulerOutput(scheduled_new_reqs=[NewRequestData(req_id=cmpl-bench-0a333e52-45-0,prompt_token_ids_len=282,mm_features=[],sampling_params=SamplingParams(n=1, presence_penalty=0.0, frequency_penalty=0.0, repetition_penalty=1.0, temperature=0.0, top_p=1.0, top_k=0, min_p=0.0, seed=None, stop=[], stop_token_ids=[106], bad_words=[], include_stop_str_in_output=False, ignore_eos=False, max_tokens=493, min_tokens=0, logprobs=None, prompt_logprobs=None, skip_special_tokens=True, spaces_between_special_tokens=True, truncate_prompt_tokens=None, structured_outputs=None, extra_args=None),block_ids=([7974, 7975, 7976, 7977, 7978, 7979, 7980, 7981, 7982, 7983, 7984, 7985, 7986, 7987, 7988, 7989, 7990, 7991], [7992, 7993, 7994, 7995, 7996, 7997, 7998, 7999, 8000, 8001, 8002, 8003, 8004, 8005, 8006, 8007, 8008, 8009], [8010, 8011, 8012, 8013, 8014, 8015, 8016, 8017, 8018, 8019, 8020, 8021, 8022, 8023, 8024, 8025, 8026, 8027], [8028, 8029, 8030, 8031, 8032, 8033, 8034, 8035, 8036, 8037, 8038, 8039, 8040, 8041, 8042, 8043, 8044, 8045], [8046, 8047, 8048, 8049, 8050, 8051, 8052, 8053, 8054, 8055, 8056, 8057, 8058, 8059, 8060, 8061, 8062, 8063], [8064, 8065, 8066, 8067, 8068, 8069, 8070, 8071, 8072, 8073, 8074, 8075, 8076, 8077, 8078, 8079, 8080, 8081], [8082, 8083, 8084, 8085, 8086, 8087, 8088, 8089, 8090, 8091, 8092, 8093, 8094, 8095, 8096, 8097, 8098, 8099]),num_computed_tokens=0,lora_request=None,prompt_embeds_shape=None)], scheduled_cached_reqs=CachedRequestData(req_ids=['cmpl-bench-0a333e52-5-0', 'cmpl-bench-0a333e52-20-0', 'cmpl-bench-0a333e52-21-0', 'cmpl-bench-0a333e52-26-0', 'cmpl-bench-0a333e52-34-0', 'cmpl-bench-0a333e52-35-0', 'cmpl-bench-0a333e52-36-0', 'cmpl-bench-0a333e52-39-0', 'cmpl-bench-0a333e52-40-0', 'cmpl-bench-0a333e52-43-0', 'cmpl-bench-0a333e52-44-0'], resumed_req_ids=[], new_token_ids=[], all_token_ids={}, new_block_ids=[null, null, null, null, null, null, null, null, null, null, null], num_computed_tokens=[877, 1009, 430, 726, 538, 213, 838, 87, 79, 47, 27], num_output_tokens=[849, 401, 372, 323, 184, 177, 159, 72, 63, 36, 21]), num_scheduled_tokens={cmpl-bench-0a333e52-40-0: 1, cmpl-bench-0a333e52-43-0: 1, cmpl-bench-0a333e52-44-0: 1, cmpl-bench-0a333e52-45-0: 282, cmpl-bench-0a333e52-39-0: 1, cmpl-bench-0a333e52-20-0: 1, cmpl-bench-0a333e52-5-0: 1, cmpl-bench-0a333e52-26-0: 1, cmpl-bench-0a333e52-21-0: 1, cmpl-bench-0a333e52-34-0: 1, cmpl-bench-0a333e52-36-0: 1, cmpl-bench-0a333e52-35-0: 1}, total_num_scheduled_tokens=293, scheduled_spec_decode_tokens={}, scheduled_encoder_inputs={}, num_common_prefix_blocks=[0, 0, 0, 0, 0, 0, 0], finished_req_ids=[], free_encoder_mm_hashes=[], preempted_req_ids=[], pending_structured_output_tokens=false, kv_connector_metadata=null, ec_connector_metadata=null) (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [dump_input.py:81] Dumping scheduler stats: SchedulerStats(num_running_reqs=12, num_waiting_reqs=0, step_counter=0, current_wave=0, kv_cache_usage=0.09605539236256821, prefix_cache_stats=PrefixCacheStats(reset=False, requests=1, queries=282, hits=0, preempted_requests=0, preempted_queries=0, preempted_hits=0), connector_prefix_cache_stats=None, kv_cache_eviction_events=[], spec_decoding_stats=None, kv_connector_stats=None, waiting_lora_adapters={}, running_lora_adapters={}, cudagraph_stats=None) (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] EngineCore encountered a fatal error. (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] Traceback (most recent call last): (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 859, in run_engine_core (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] engine_core.run_busy_loop() (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ~~~~~~~~~~~~~~~~~~~~~~~~~^^ (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 886, in run_busy_loop (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] self._process_engine_step() (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ~~~~~~~~~~~~~~~~~~~~~~~~~^^ (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 919, in _process_engine_step (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] outputs, model_executed = self.step_fn() (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ~~~~~~~~~~~~^^ (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 353, in step (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] model_output = self.model_executor.sample_tokens(grammar_output) (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/multiproc_executor.py", line 271, in sample_tokens (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] return self.collective_rpc( (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ~~~~~~~~~~~~~~~~~~~^ (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] "sample_tokens", (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ^^^^^^^^^^^^^^^^ (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ...<4 lines>... (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] kv_output_aggregator=self.kv_output_aggregator, (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ) (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ^ (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/multiproc_executor.py", line 361, in collective_rpc (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] return aggregate(get_response()) (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ~~~~~~~~~~~~^^ (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/multiproc_executor.py", line 338, in get_response (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] status, result = mq.dequeue( (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ~~~~~~~~~~^ (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] timeout=dequeue_timeout, cancel=shutdown_event (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ) (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ^ (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/distributed/device_communicators/shm_broadcast.py", line 616, in dequeue (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] with self.acquire_read(timeout, cancel, indefinite) as buf: (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] ~~~~~~~~~~~~~~~~~^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] File "/usr/lib64/python3.13/contextlib.py", line 141, in __enter__ (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] return next(self.gen) (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] File "/opt/venv/lib64/python3.13/site-packages/vllm/distributed/device_communicators/shm_broadcast.py", line 531, in acquire_read (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] raise RuntimeError("cancelled") (EngineCore_DP0 pid=77851) ERROR 12-19 17:38:20 [core.py:868] RuntimeError: cancelled (EngineCore_DP0 pid=77851) Process EngineCore_DP0: (EngineCore_DP0 pid=77851) Traceback (most recent call last): (EngineCore_DP0 pid=77851) File "/usr/lib64/python3.13/multiprocessing/process.py", line 313, in _bootstrap (EngineCore_DP0 pid=77851) self.run() (EngineCore_DP0 pid=77851) ~~~~~~~~^^ (EngineCore_DP0 pid=77851) File "/usr/lib64/python3.13/multiprocessing/process.py", line 108, in run (EngineCore_DP0 pid=77851) self._target(*self._args, **self._kwargs) (EngineCore_DP0 pid=77851) ~~~~~~~~~~~~^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (EngineCore_DP0 pid=77851) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 870, in run_engine_core (EngineCore_DP0 pid=77851) raise e (EngineCore_DP0 pid=77851) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 859, in run_engine_core (EngineCore_DP0 pid=77851) engine_core.run_busy_loop() (EngineCore_DP0 pid=77851) ~~~~~~~~~~~~~~~~~~~~~~~~~^^ (EngineCore_DP0 pid=77851) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 886, in run_busy_loop (EngineCore_DP0 pid=77851) self._process_engine_step() (EngineCore_DP0 pid=77851) ~~~~~~~~~~~~~~~~~~~~~~~~~^^ (EngineCore_DP0 pid=77851) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 919, in _process_engine_step (EngineCore_DP0 pid=77851) outputs, model_executed = self.step_fn() (EngineCore_DP0 pid=77851) ~~~~~~~~~~~~^^ (EngineCore_DP0 pid=77851) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core.py", line 353, in step (EngineCore_DP0 pid=77851) model_output = self.model_executor.sample_tokens(grammar_output) (EngineCore_DP0 pid=77851) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/multiproc_executor.py", line 271, in sample_tokens (EngineCore_DP0 pid=77851) return self.collective_rpc( (EngineCore_DP0 pid=77851) ~~~~~~~~~~~~~~~~~~~^ (EngineCore_DP0 pid=77851) "sample_tokens", (EngineCore_DP0 pid=77851) ^^^^^^^^^^^^^^^^ (EngineCore_DP0 pid=77851) ...<4 lines>... (EngineCore_DP0 pid=77851) kv_output_aggregator=self.kv_output_aggregator, (EngineCore_DP0 pid=77851) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (EngineCore_DP0 pid=77851) ) (EngineCore_DP0 pid=77851) ^ (EngineCore_DP0 pid=77851) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/multiproc_executor.py", line 361, in collective_rpc (EngineCore_DP0 pid=77851) return aggregate(get_response()) (EngineCore_DP0 pid=77851) ~~~~~~~~~~~~^^ (EngineCore_DP0 pid=77851) File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/executor/multiproc_executor.py", line 338, in get_response (EngineCore_DP0 pid=77851) status, result = mq.dequeue( (EngineCore_DP0 pid=77851) ~~~~~~~~~~^ (EngineCore_DP0 pid=77851) timeout=dequeue_timeout, cancel=shutdown_event (EngineCore_DP0 pid=77851) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (EngineCore_DP0 pid=77851) ) (EngineCore_DP0 pid=77851) ^ (EngineCore_DP0 pid=77851) File "/opt/venv/lib64/python3.13/site-packages/vllm/distributed/device_communicators/shm_broadcast.py", line 616, in dequeue (EngineCore_DP0 pid=77851) with self.acquire_read(timeout, cancel, indefinite) as buf: (EngineCore_DP0 pid=77851) ~~~~~~~~~~~~~~~~~^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (EngineCore_DP0 pid=77851) File "/usr/lib64/python3.13/contextlib.py", line 141, in __enter__ (EngineCore_DP0 pid=77851) return next(self.gen) (EngineCore_DP0 pid=77851) File "/opt/venv/lib64/python3.13/site-packages/vllm/distributed/device_communicators/shm_broadcast.py", line 531, in acquire_read (EngineCore_DP0 pid=77851) raise RuntimeError("cancelled") (EngineCore_DP0 pid=77851) RuntimeError: cancelled (APIServer pid=77686) ERROR 12-19 17:38:20 [async_llm.py:538] AsyncLLM output_handler failed. (APIServer pid=77686) ERROR 12-19 17:38:20 [async_llm.py:538] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [async_llm.py:538] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [async_llm.py:538] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [async_llm.py:538] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [async_llm.py:538] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [async_llm.py:538] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [async_llm.py:538] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Error in completion stream generator. (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] Traceback (most recent call last): (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/entrypoints/openai/serving_completion.py", line 352, in completion_stream_generator (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for prompt_idx, res in result_generator: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ...<125 lines>... (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield f"data: {response_json}\n\n" (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/utils/async_utils.py", line 278, in merge_async_iterators (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] async for item in iterators[0]: (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] yield 0, item (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 436, in generate (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] out = q.get_nowait() or await q.get() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/output_processor.py", line 70, in get (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise output (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/async_llm.py", line 490, in output_handler (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] outputs = await engine_core.get_output_async() (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] File "/opt/venv/lib64/python3.13/site-packages/vllm/v1/engine/core_client.py", line 895, in get_output_async (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] raise self._format_exception(outputs) from None (APIServer pid=77686) ERROR 12-19 17:38:20 [serving_completion.py:513] vllm.v1.engine.exceptions.EngineDeadError: EngineCore encountered an issue. See stack trace (above) for the root cause. (APIServer pid=77686) INFO: Shutting down (APIServer pid=77686) INFO: Waiting for application shutdown. (APIServer pid=77686) INFO: Application shutdown complete. (APIServer pid=77686) INFO: Finished server process [77686] /usr/lib64/python3.13/multiprocessing/resource_tracker.py:324: UserWarning: resource_tracker: There appear to be 2 leaked semaphore objects to clean up at shutdown: {'/mp-zs3r7w6q', '/mp-sdlfr_2q'} warnings.warn( /usr/lib64/python3.13/multiprocessing/resource_tracker.py:324: UserWarning: resource_tracker: There appear to be 3 leaked shared_memory objects to clean up at shutdown: {'/psm_0f0e988c', '/psm_760784ea', '/psm_817cd347'} warnings.warn(