Sign inSign up

sirensolutions/vllm-tunneled-runpod:v1

Manifest digest

sha256:d9dcd1b54c9a5729a3d93112985f5ff05ee659a61418ea7112d5749635bfbddd

OS/ARCH

linux/amd64

Compressed size

10.72 GB

Last pushed

about 1 month by almico

Type

Image

Manifest digest

sha256:d9dcd1b54c9a5729a3d93112985f5ff05ee659a61418ea7112d5749635bfbddd

Image Layers

1ARG RELEASE0 B
2ARG LAUNCHPAD_BUILD_ARCH0 B
3LABEL org.opencontainers.image.ref.name=ubuntu0 B
4LABEL org.opencontainers.image.version=24.040 B
5ADD file ... in / 29.17 MB
6CMD ["/bin/bash"]0 B
7ENV NVARCH=x86_640 B
8ENV NVIDIA_REQUIRE_CUDA=cuda>=12.9 brand=unknown,driver>=535,driver<536 brand=grid,driver>=535,driver<536 brand=tesla,driver>=535,driver<5360 B
9ENV NV_CUDA_CUDART_VERSION=12.9.79-10 B
10ARG TARGETARCH0 B
11LABEL maintainer=NVIDIA CORPORATION <[email protected]>0 B
12RUN |1 TARGETARCH=amd64 /bin/sh -c4.34 MB
13ENV CUDA_VERSION=12.9.10 B
14RUN |1 TARGETARCH=amd64 /bin/sh -c98.72 MB
15RUN |1 TARGETARCH=amd64 /bin/sh -c182 B
16ENV PATH=/usr/local/cuda/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin0 B
17ENV LD_LIBRARY_PATH=/usr/local/cuda/lib640 B
18COPY NGC-DL-CONTAINER-LICENSE / # buildkit6.72 KB
19ENV NVIDIA_VISIBLE_DEVICES=all0 B
20ENV NVIDIA_DRIVER_CAPABILITIES=compute,utility0 B
21ARG CUDA_VERSION0 B
22ARG PYTHON_VERSION0 B
23ARG NCCL_VERSION0 B
24ARG DEADSNAKES_MIRROR_URL0 B
25ARG DEADSNAKES_GPGKEY_URL0 B
26ARG GET_PIP_URL0 B
27ENV DEBIAN_FRONTEND=noninteractive0 B
28WORKDIR /vllm-workspace104 B
29RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7230 B
30RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7222.51 MB
31RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.71.58 GB
32RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.743.15 MB
33ENV UV_HTTP_TIMEOUT=5000 B
34ENV UV_INDEX_STRATEGY=unsafe-best-match0 B
35ENV UV_LINK_MODE=copy0 B
36ENV UV_PYTHON_INSTALL_DIR=/opt/uv/python0 B
37ENV UV_CACHE_DIR=/opt/uv/cache0 B
38RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7150 B
39RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7164 B
40ENV UV_OVERRIDE=/etc/uv-overrides.txt0 B
41RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.73.62 KB
42COPY docker/entrypoints/vllm-nonroot-entrypoint.sh /usr/local/bin/vllm-nonroot-entrypoint.sh # buildkit2.03 KB
43RUN |6 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.72.03 KB
44ENV VLLM_ENABLE_CUDA_COMPATIBILITY=00 B
45ARG PYTORCH_CUDA_INDEX_BASE_URL0 B
46COPY requirements/common.txt /tmp/common.txt # buildkit1.62 KB
47COPY requirements/cuda.txt /tmp/requirements-cuda.txt # buildkit872 B
48RUN |7 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.75.53 GB
49ARG FLASHINFER_VERSION=0.6.16.post30 B
50RUN |8 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.71.8 GB
51ARG GDRCOPY_CUDA_VERSION=12.80 B
52ARG GDRCOPY_OS_VERSION=Ubuntu22_040 B
53ARG TARGETPLATFORM0 B
54COPY tools/install_gdrcopy.sh /tmp/install_gdrcopy.sh # buildkit897 B
55RUN |11 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7522.27 KB
56ARG BITSANDBYTES_VERSION_X86=0.46.10 B
57ARG BITSANDBYTES_VERSION_ARM64=0.42.00 B
58ARG TIMM_VERSION=>=1.0.170 B
59ARG RUNAI_MODEL_STREAMER_VERSION=>=0.15.70 B
60RUN |15 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.797.47 MB
61ARG PIP_INDEX_URL UV_INDEX_URL0 B
62ARG PIP_EXTRA_INDEX_URL UV_EXTRA_INDEX_URL0 B
63ARG PYTORCH_CUDA_INDEX_BASE_URL0 B
64ARG PIP_KEYRING_PROVIDER UV_KEYRING_PROVIDER0 B
65ARG PYTORCH_NIGHTLY0 B
66COPY /workspace/torch_lib_versions.txt torch_lib_versions.txt # buildkit202 B
67COPY /workspace/dist/wheel.sha256 /tmp/vllm-wheel.sha256 # buildkit229 B
68RUN |23 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.7514.81 MB
69RUN |23 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.732 B
70ENV LD_LIBRARY_PATH=/usr/local/cuda/lib64:/usr/local/cuda/lib640 B
71COPY /tmp/ep_kernels_workspace/dist/wheels.sha256 /tmp/ep-kernels-wheels.sha256 # buildkit254 B
72RUN |23 CUDA_VERSION=12.9.1 PYTHON_VERSION=3.12 NCCL_VERSION=2.30.718.68 MB
73ENV LD_LIBRARY_PATH=/usr/local/nvidia/lib64:/usr/local/cuda/lib64:/usr/local/cuda/lib640 B
74COPY examples examples # buildkit261.98 KB
75COPY benchmarks benchmarks # buildkit271.84 KB
76COPY ./vllm/collect_env.py . # buildkit9.62 KB
77ARG TARGETPLATFORM0 B
78ARG INSTALL_KV_CONNECTORS=false0 B
79ARG CUDA_VERSION0 B
80ARG VLLM_BUILD_COMMIT0 B
81ARG VLLM_BUILD_PIPELINE0 B
82ARG VLLM_BUILD_URL0 B
83ARG VLLM_IMAGE_TAG0 B
84ARG PIP_INDEX_URL UV_INDEX_URL0 B
85ARG PIP_EXTRA_INDEX_URL UV_EXTRA_INDEX_URL0 B
86ENV UV_HTTP_TIMEOUT=5000 B
87ARG torch_cuda_arch_list=7.5 8.0 8.6 8.90 B
88ENV TORCH_CUDA_ARCH_LIST=7.5 8.0 8.6 8.90 B
89RUN |12 TARGETPLATFORM=linux/amd64 INSTALL_KV_CONNECTORS=true CUDA_VERSION=12.9.1295.03 MB
90ARG MOONCAKE_WHEEL_AARCH640 B
91ARG MOONCAKE_WHEEL_X86_640 B
92RUN |14 TARGETPLATFORM=linux/amd64 INSTALL_KV_CONNECTORS=true CUDA_VERSION=12.9.1460.07 MB
93ENV VLLM_USAGE_SOURCE=production-docker-image0 B
94ENV VLLM_BUILD_COMMIT=6e448d0ea9bf3d88d898b65449ca6dc2aec170ac VLLM_BUILD_PIPELINE=019d130e-464e-4ff7-b84b-492992c0c06b VLLM_BUILD_URL=https://buildkite.com/vllm/release-v2/builds/5006 VLLM_IMAGE_TAG=vllm/vllm-openai:v0.27.1-cu129-ubuntu24040 B
95LABEL org.opencontainers.image.source=https://github.com/vllm-project/vllm org.opencontainers.image.revision=6e448d0ea9bf3d88d898b65449ca6dc2aec170ac org.opencontainers.image.version=vllm/vllm-openai:v0.27.1-cu129-ubuntu2404 org.opencontainers.image.url=https://buildkite.com/vllm/release-v2/builds/50060 B
96ENTRYPOINT ["vllm" "serve"]0 B
97RUN /bin/sh -c apt-get update42.8 MB
98RUN /bin/sh -c curl -1sLf17.01 MB
99COPY pod_exporter.py /opt/pod_exporter.py # buildkit3.4 KB
100RUN /bin/sh -c mkdir -p153 B
101COPY froggeric-chat-template-v22.1.jinja /opt/chat-templates/ # buildkit4.14 KB
102RUN /bin/sh -c mkdir -p32 B
103COPY Caddyfile /etc/caddy/Caddyfile # buildkit294 B
104RUN /bin/sh -c python3 -m3.75 MB
105COPY start.sh /usr/local/bin/start.sh # buildkit647 B
106RUN /bin/sh -c chmod +x645 B
107ENTRYPOINT ["/usr/local/bin/start.sh"]0 B

Command

 ARG RELEASE