sha256:47ff6d976098f1a6de17a0ee4bbd9f814c805f2858e81e67b016e0d604b167c5
OS/ARCH
linux/amd64
Compressed size
5.09 GB
Last pushed
almost 2 years by peakji92
Type
Image
Manifest digest
sha256:6fbbae59dd74de84654d59a082b6bf3f15b0aea898893d0b4953e8cb9306926e
Image Layers
1ARG RELEASE0 B2ARG LAUNCHPAD_BUILD_ARCH0 B3LABEL org.opencontainers.image.ref.name=ubuntu0 B4LABEL org.opencontainers.image.version=22.040 B5ADD file ... in / 28.17 MB6CMD ["/bin/bash"]0 B7ENV NVARCH=x86_640 B8ENV NVIDIA_REQUIRE_CUDA=cuda>=12.1 brand=tesla,driver>=470,driver<471 brand=unknown,driver>=470,driver<471 brand=nvidia,driver>=470,driver<4710 B9ENV NV_CUDA_CUDART_VERSION=12.1.55-10 B10ENV NV_CUDA_COMPAT_PACKAGE=cuda-compat-12-10 B11ARG TARGETARCH0 B13RUN |1 TARGETARCH=amd64 /bin/sh -c4.41 MB14ENV CUDA_VERSION=12.1.00 B15RUN |1 TARGETARCH=amd64 /bin/sh -c53.15 MB16RUN |1 TARGETARCH=amd64 /bin/sh -c185 B17ENV PATH=/usr/local/nvidia/bin:/usr/local/cuda/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin0 B18ENV LD_LIBRARY_PATH=/usr/local/nvidia/lib:/usr/local/nvidia/lib640 B19COPY NGC-DL-CONTAINER-LICENSE / # buildkit6.72 KB20ENV NVIDIA_VISIBLE_DEVICES=all0 B21ENV NVIDIA_DRIVER_CAPABILITIES=compute,utility0 B22ARG CUDA_VERSION=12.4.10 B23ARG PYTHON_VERSION=3.120 B24WORKDIR /vllm-workspace104 B25ENV DEBIAN_FRONTEND=noninteractive0 B26ARG TARGETPLATFORM0 B27COPY requirements-cuda-arm64.txt requirements-cuda-arm64.txt # buildkit271 B28RUN |3 CUDA_VERSION=12.1.0 PYTHON_VERSION=3.12 TARGETPLATFORM=linux/amd64229 B29RUN |3 CUDA_VERSION=12.1.0 PYTHON_VERSION=3.12 TARGETPLATFORM=linux/amd64406.96 MB30RUN |3 CUDA_VERSION=12.1.0 PYTHON_VERSION=3.12 TARGETPLATFORM=linux/amd6411.11 KB31RUN |3 CUDA_VERSION=12.1.0 PYTHON_VERSION=3.12 TARGETPLATFORM=linux/amd643.27 GB32RUN |3 CUDA_VERSION=12.1.0 PYTHON_VERSION=3.12 TARGETPLATFORM=linux/amd6432 B33RUN |3 CUDA_VERSION=12.1.0 PYTHON_VERSION=3.12 TARGETPLATFORM=linux/amd641.25 GB34COPY examples examples # buildkit73.1 KB35RUN /bin/sh -c if [87.56 MB36ENV VLLM_USAGE_SOURCE=production-docker-image0 B37ENTRYPOINT ["python3" "-m" "vllm.entrypoints.openai.api_server"]0 B38COPY docker-entrypoint.sh docker-entrypoint.sh # buildkit1.52 KB39RUN /bin/sh -c chmod u+x1.52 KB40EXPOSE map[80/tcp:{}]0 B41ENV VLLM_NO_USAGE_STATS=10 B42ENV VLLM_DO_NOT_TRACK=10 B43ENV VLLM_LOGGING_LEVEL=WARNING0 B44ENV VLLM_NO_DEPRECATION_WARNING=10 B45ENV HOST=0.0.0.00 B46ENV PORT=800 B47ENV UVICORN_LOG_LEVEL=warning0 B48ENV MODEL=peakji/qwen2.5-1.5b-instruct-trim0 B49ENV TASK=0 B50ENV REVISION=0 B51ENV TRUST_REMOTE_CODE=0 B52ENV LOAD_FORMAT=0 B53ENV DTYPE=0 B54ENV DOWNLOAD_DIR=0 B55ENV KV_CACHE_DTYPE=0 B56ENV MAX_MODEL_LEN=0 B57ENV PIPELINE_PARALLEL_SIZE=0 B58ENV TENSOR_PARALLEL_SIZE=0 B59ENV MAX_PARALLEL_LOADING_WORKERS=0 B60ENV BLOCK_SIZE=0 B61ENV ENABLE_PREFIX_CACHING=0 B62ENV DISABLE_SLIDING_WINDOW=0 B63ENV SEED=0 B64ENV SWAP_SPACE=0 B65ENV CPU_OFFLOAD_GB=0 B66ENV GPU_MEMORY_UTILIZATION=0 B67ENV MAX_NUM_BATCHED_TOKENS=0 B68ENV MAX_NUM_SEQS=0 B69ENV MAX_LOGPROBS=0 B70ENV DISABLE_LOG_STATS=true0 B71ENV QUANTIZATION=0 B72ENV MAX_SEQ_LEN_TO_CAPTURE=0 B73ENV LIMIT_MM_PER_PROMPT=0 B74ENV NUM_SCHEDULER_STEPS=0 B75ENV SCHEDULER_DELAY_FACTOR=0 B76ENV ENABLE_CHUNKED_PREFILL=0 B77ENV SPECULATIVE_MODEL=0 B78ENV SPECULATIVE_MODEL_QUANTIZATION=0 B79ENV NUM_SPECULATIVE_TOKENS=0 B80ENV SPECULATIVE_DRAFT_TENSOR_PARALLEL_SIZE=0 B81ENV SPECULATIVE_MAX_MODEL_LEN=0 B82ENV SPECULATIVE_DISABLE_BY_BATCH_SIZE=0 B83ENV NGRAM_PROMPT_LOOKUP_MAX=0 B84ENV NGRAM_PROMPT_LOOKUP_MIN=0 B85ENV SPEC_DECODING_ACCEPTANCE_METHOD=0 B86ENV TYPICAL_ACCEPTANCE_SAMPLER_POSTERIOR_THRESHOLD=0 B87ENV TYPICAL_ACCEPTANCE_SAMPLER_POSTERIOR_ALPHA=0 B88ENV SERVED_MODEL_NAME=0 B89ENV DISABLE_LOG_REQUESTS=true0 B90ENTRYPOINT ["./docker-entrypoint.sh"]0 BCommand
ARG RELEASE