Sign inSign up

secondstate/qwen-2-0.5b-allminilm-2:cuda11

Multi-platform
Machine learning & AI
Developer tools
Index digest

sha256:3aa18e963b177ea6d69c4d248dde914a222dbe6d68d5ff4d6c831458c7d272e9

OS/ARCH

Compressed size

890.74 MB

Last pushed

over 2 years by juntaoyuan

Type

Image

Manifest digest

sha256:2ab5de6e39e84474891ea8441662329dfd87a4a25552413489a6aa75ddc5090e

Image Layers

1ARG RELEASE0 B
2ARG LAUNCHPAD_BUILD_ARCH0 B
3LABEL org.opencontainers.image.ref.name=ubuntu0 B
4LABEL org.opencontainers.image.version=20.040 B
5ADD file ... in / 26.23 MB
6CMD ["/bin/bash"]0 B
7ENV NVARCH=x86_640 B
8ENV NVIDIA_REQUIRE_CUDA=cuda>=11.40 B
9ENV NV_CUDA_CUDART_VERSION=11.4.148-10 B
10ENV NV_CUDA_COMPAT_PACKAGE=cuda-compat-11-40 B
11ARG TARGETARCH0 B
12LABEL maintainer=NVIDIA CORPORATION <[email protected]>0 B
13RUN |1 TARGETARCH=amd64 /bin/sh -c7.58 MB
14ENV CUDA_VERSION=11.4.30 B
15RUN |1 TARGETARCH=amd64 /bin/sh -c10.94 MB
16RUN |1 TARGETARCH=amd64 /bin/sh -c187 B
17ENV PATH=/usr/local/nvidia/bin:/usr/local/cuda/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin0 B
18ENV LD_LIBRARY_PATH=/usr/local/nvidia/lib:/usr/local/nvidia/lib640 B
19COPY NGC-DL-CONTAINER-LICENSE / # buildkit6.72 KB
20ENV NVIDIA_VISIBLE_DEVICES=all0 B
21ENV NVIDIA_DRIVER_CAPABILITIES=compute,utility0 B
22ARG CHAT_MODEL_FILE0 B
23ARG EMBEDDING_MODEL_FILE0 B
24ARG PROMPT_TEMPLATE0 B
25ENV CHAT_MODEL_FILE=Qwen2-0.5B-Instruct-Q5_K_M.gguf0 B
26ENV EMBEDDING_MODEL_FILE=all-MiniLM-L6-v2-ggml-model-f16.gguf0 B
27ENV PROMPT_TEMPLATE=chatml0 B
28RUN |3 CHAT_MODEL_FILE=Qwen2-0.5B-Instruct-Q5_K_M.gguf EMBEDDING_MODEL_FILE=all-MiniLM-L6-v2-ggml-model-f16.gguf PROMPT_TEMPLATE=chatml328.2 MB
29RUN |3 CHAT_MODEL_FILE=Qwen2-0.5B-Instruct-Q5_K_M.gguf EMBEDDING_MODEL_FILE=all-MiniLM-L6-v2-ggml-model-f16.gguf PROMPT_TEMPLATE=chatml96 B
30COPY Qwen2-0.5B-Instruct-Q5_K_M.gguf /models/Qwen2-0.5B-Instruct-Q5_K_M.gguf # buildkit388.25 MB
31COPY all-MiniLM-L6-v2-ggml-model-f16.gguf /models/all-MiniLM-L6-v2-ggml-model-f16.gguf # buildkit39.93 MB
32RUN |3 CHAT_MODEL_FILE=Qwen2-0.5B-Instruct-Q5_K_M.gguf EMBEDDING_MODEL_FILE=all-MiniLM-L6-v2-ggml-model-f16.gguf PROMPT_TEMPLATE=chatml85.21 MB
33RUN |3 CHAT_MODEL_FILE=Qwen2-0.5B-Instruct-Q5_K_M.gguf EMBEDDING_MODEL_FILE=all-MiniLM-L6-v2-ggml-model-f16.gguf PROMPT_TEMPLATE=chatml2.71 MB
34RUN |3 CHAT_MODEL_FILE=Qwen2-0.5B-Instruct-Q5_K_M.gguf EMBEDDING_MODEL_FILE=all-MiniLM-L6-v2-ggml-model-f16.gguf PROMPT_TEMPLATE=chatml1.68 MB
35COPY run.sh . # buildkit373 B
36RUN |3 CHAT_MODEL_FILE=Qwen2-0.5B-Instruct-Q5_K_M.gguf EMBEDDING_MODEL_FILE=all-MiniLM-L6-v2-ggml-model-f16.gguf PROMPT_TEMPLATE=chatml374 B
37ENTRYPOINT ["/bin/sh" "-c" "./run.sh $CHAT_MODEL_FILE0 B

Command

 ARG RELEASE