x
This commit is contained in:
@@ -7,6 +7,9 @@ ENV LOCAL_MODEL_DIR=/opt/model
|
|||||||
# Create necessary directories
|
# Create necessary directories
|
||||||
RUN mkdir -p /opt/script /opt/model /config
|
RUN mkdir -p /opt/script /opt/model /config
|
||||||
|
|
||||||
|
# Update transformers to support qwen3_5_moe architecture
|
||||||
|
RUN pip install --upgrade transformers
|
||||||
|
|
||||||
# Copy scripts to /opt/script
|
# Copy scripts to /opt/script
|
||||||
COPY scripts/start_vllm.py /opt/script/start-vllm
|
COPY scripts/start_vllm.py /opt/script/start-vllm
|
||||||
COPY benchmarks/run_vllm_bench.py /opt/script/run_vllm_bench.py
|
COPY benchmarks/run_vllm_bench.py /opt/script/run_vllm_bench.py
|
||||||
|
|||||||
+1
-1
@@ -1,5 +1,5 @@
|
|||||||
{
|
{
|
||||||
"default_model": "Qwen3-Coder-30B-A3B-Instruct-GPTQ-4bit",
|
"default_model": "Qwen3.5-35B-A3B-GPTQ-Int4",
|
||||||
"models": {
|
"models": {
|
||||||
"gpt-oss-20b": {
|
"gpt-oss-20b": {
|
||||||
"ctx": "32768",
|
"ctx": "32768",
|
||||||
|
|||||||
Reference in New Issue
Block a user