sha256:be4945a0ded064e1d275700e0e2aa4818549b8d69cffe7ed721834836e73f60d
OS/ARCH
linux/arm64
Compressed size
9.03 GB
Last pushed
19 days by vllmbot
Type
Image
Manifest digest
sha256:be4945a0ded064e1d275700e0e2aa4818549b8d69cffe7ed721834836e73f60d
Image Layers
1ARG RELEASE0 B2ARG LAUNCHPAD_BUILD_ARCH0 B3LABEL org.opencontainers.image.version=24.040 B4ADD file ... in / 27.54 MB5CMD ["/bin/bash"]0 B6ENV NVARCH=sbsa0 B7ENV NVIDIA_REQUIRE_CUDA=cuda>=13.0 brand=unknown,driver>=535,driver<536 brand=grid,driver>=535,driver<536 brand=tesla,driver>=535,driver<5360 B8ENV NV_CUDA_CUDART_VERSION=13.0.96-10 B9ARG TARGETARCH0 B11RUN |1 TARGETARCH=arm64 /bin/sh -c6.44 MB12ENV CUDA_VERSION=13.0.30 B13RUN |1 TARGETARCH=arm64 /bin/sh -c367.96 KB14RUN |1 TARGETARCH=arm64 /bin/sh -c94.84 MB15RUN |1 TARGETARCH=arm64 /bin/sh -c32 B16RUN |1 TARGETARCH=arm64 /bin/sh -c187 B17ENV PATH=/usr/local/nvidia/bin:/usr/local/cuda/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin0 B18ENV LD_LIBRARY_PATH=/usr/local/nvidia/lib:/usr/local/nvidia/lib64:/usr/local/cuda/lib640 B19COPY NGC-DL-CONTAINER-LICENSE / # buildkit6.72 KB20ENV NVIDIA_VISIBLE_DEVICES=all0 B21ENV NVIDIA_DRIVER_CAPABILITIES=compute,utility0 B22ARG CUDA_VERSION0 B23ARG PYTHON_VERSION0 B24ARG NCCL_VERSION0 B25ARG DEADSNAKES_MIRROR_URL0 B26ARG DEADSNAKES_GPGKEY_URL0 B27ARG GET_PIP_URL0 B28ENV DEBIAN_FRONTEND=noninteractive0 B29WORKDIR /vllm-workspace104 B30RUN |6 CUDA_VERSION=13.0.3 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7227 B31RUN |6 CUDA_VERSION=13.0.3 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7213.49 MB32RUN |6 CUDA_VERSION=13.0.3 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.71.45 GB33RUN |6 CUDA_VERSION=13.0.3 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.743.44 MB34ENV UV_HTTP_TIMEOUT=5000 B35ENV UV_INDEX_STRATEGY=unsafe-best-match0 B36ENV UV_LINK_MODE=copy0 B37ENV UV_PYTHON_INSTALL_DIR=/opt/uv/python0 B38ENV UV_CACHE_DIR=/opt/uv/cache0 B39RUN |6 CUDA_VERSION=13.0.3 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7150 B40RUN |6 CUDA_VERSION=13.0.3 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7163 B41ENV UV_OVERRIDE=/etc/uv-overrides.txt0 B42RUN |6 CUDA_VERSION=13.0.3 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.73.62 KB43COPY docker/entrypoints/vllm-nonroot-entrypoint.sh /usr/local/bin/vllm-nonroot-entrypoint.sh # buildkit2.03 KB44RUN |6 CUDA_VERSION=13.0.3 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.72.03 KB45ENV VLLM_ENABLE_CUDA_COMPATIBILITY=00 B46ARG PYTORCH_CUDA_INDEX_BASE_URL0 B47COPY requirements/common.txt /tmp/common.txt # buildkit1.63 KB48COPY requirements/cuda.txt /tmp/requirements-cuda.txt # buildkit871 B49RUN |7 CUDA_VERSION=13.0.3 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.74.39 GB50ARG FLASHINFER_VERSION=0.6.16.post30 B51RUN |8 CUDA_VERSION=13.0.3 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.71.57 GB52ARG GDRCOPY_CUDA_VERSION=12.80 B53ARG GDRCOPY_OS_VERSION=Ubuntu24_040 B54ARG TARGETPLATFORM0 B55COPY tools/install_gdrcopy.sh /tmp/install_gdrcopy.sh # buildkit897 B56RUN |11 CUDA_VERSION=13.0.3 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7518.53 KB57ARG TIMM_VERSION=>=1.0.170 B58ARG RUNAI_MODEL_STREAMER_VERSION=>=0.15.70 B59RUN |13 CUDA_VERSION=13.0.3 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7270.99 MB60ARG PIP_INDEX_URL UV_INDEX_URL0 B61ARG PIP_EXTRA_INDEX_URL UV_EXTRA_INDEX_URL0 B62ARG PYTORCH_CUDA_INDEX_BASE_URL0 B63ARG PIP_KEYRING_PROVIDER UV_KEYRING_PROVIDER0 B64ARG PYTORCH_NIGHTLY0 B65COPY /workspace/torch_lib_versions.txt torch_lib_versions.txt # buildkit197 B66COPY /workspace/dist/wheel.sha256 /tmp/vllm-wheel.sha256 # buildkit235 B67RUN |8 PIP_INDEX_URL= UV_INDEX_URL= PIP_EXTRA_INDEX_URL=494.28 MB68RUN |8 PIP_INDEX_URL= UV_INDEX_URL= PIP_EXTRA_INDEX_URL=32 B69ENV LD_LIBRARY_PATH=/usr/local/cuda/lib64:/usr/local/nvidia/lib:/usr/local/nvidia/lib64:/usr/local/cuda/lib640 B70COPY /tmp/ep_kernels_workspace/dist/wheels.sha256 /tmp/ep-kernels-wheels.sha256 # buildkit253 B71RUN |8 PIP_INDEX_URL= UV_INDEX_URL= PIP_EXTRA_INDEX_URL=13.65 MB72ENV LD_LIBRARY_PATH=/usr/local/nvidia/lib64:/usr/local/cuda/lib64:/usr/local/nvidia/lib:/usr/local/nvidia/lib64:/usr/local/cuda/lib640 B73COPY examples examples # buildkit263.35 KB74COPY benchmarks benchmarks # buildkit283.22 KB75COPY ./vllm/collect_env.py . # buildkit9.61 KB76ARG TARGETPLATFORM0 B77ARG INSTALL_KV_CONNECTORS=false0 B78ARG CUDA_VERSION0 B79ARG VLLM_BUILD_COMMIT0 B80ARG VLLM_BUILD_PIPELINE0 B81ARG VLLM_BUILD_URL0 B82ARG VLLM_IMAGE_TAG0 B83ARG PIP_INDEX_URL UV_INDEX_URL0 B84ARG PIP_EXTRA_INDEX_URL UV_EXTRA_INDEX_URL0 B85ENV UV_HTTP_TIMEOUT=5000 B86ARG torch_cuda_arch_list=7.5 8.0 8.6 8.90 B87ENV TORCH_CUDA_ARCH_LIST=8.7 8.9 9.0 10.0+PTX0 B88RUN |12 TARGETPLATFORM=linux/arm64 INSTALL_KV_CONNECTORS=true CUDA_VERSION=13.0.3476.81 MB89ENV VLLM_USAGE_SOURCE=production-docker-image0 B90ENV VLLM_BUILD_COMMIT=unknown VLLM_BUILD_PIPELINE=local VLLM_BUILD_URL= VLLM_IMAGE_TAG=local/vllm-openai:dev0 B91LABEL org.opencontainers.image.source=https://github.com/vllm-project/vllm org.opencontainers.image.revision=unknown org.opencontainers.image.version=local/vllm-openai:dev org.opencontainers.image.url=0 B92ENTRYPOINT ["vllm" "serve"]0 BCommand
ARG RELEASE