Sign inSign up

kuzcoxyz/amd64-nvidia-inference-node:9a30699

Index digest

sha256:de99ef52ade2d048632151e3f3c44566484647646b516dcd7546a3c4b136d88b

OS/ARCH

linux/amd64

Compressed size

11.98 GB

Last pushed

4 months by kuzcoxyz

Type

Image

Manifest digest

sha256:f1650dd603c97442350975cb0af920a2119a75b337374e2ec7e06ceff3dbebed

Image Layers

1ARG RELEASE0 B
2ARG LAUNCHPAD_BUILD_ARCH0 B
3LABEL org.opencontainers.image.ref.name=ubuntu0 B
4LABEL org.opencontainers.image.version=22.040 B
5ADD file ... in / 29.04 MB
6CMD ["/bin/bash"]0 B
7ENV NVARCH=x86_640 B
8ENV NVIDIA_REQUIRE_CUDA=cuda>=13.0 brand=unknown,driver>=535,driver<536 brand=grid,driver>=535,driver<536 brand=tesla,driver>=535,driver<5360 B
9ENV NV_CUDA_CUDART_VERSION=13.0.96-10 B
10ARG TARGETARCH0 B
11LABEL maintainer=NVIDIA CORPORATION <[email protected]>0 B
12RUN |1 TARGETARCH=amd64 /bin/sh -c4.43 MB
13ENV CUDA_VERSION=13.0.20 B
14RUN |1 TARGETARCH=amd64 /bin/sh -c100.3 MB
15RUN |1 TARGETARCH=amd64 /bin/sh -c185 B
16ENV PATH=/usr/local/nvidia/bin:/usr/local/cuda/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin0 B
17ENV LD_LIBRARY_PATH=/usr/local/nvidia/lib:/usr/local/nvidia/lib64:/usr/local/cuda/lib640 B
18COPY NGC-DL-CONTAINER-LICENSE / # buildkit6.72 KB
19ENV NVIDIA_VISIBLE_DEVICES=all0 B
20ENV NVIDIA_DRIVER_CAPABILITIES=compute,utility0 B
21ARG CUDA_VERSION0 B
22ARG PYTHON_VERSION0 B
23ARG DEADSNAKES_MIRROR_URL0 B
24ARG DEADSNAKES_GPGKEY_URL0 B
25ARG GET_PIP_URL0 B
26ENV DEBIAN_FRONTEND=noninteractive0 B
27WORKDIR /vllm-workspace104 B
28RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=231 B
29RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=214.05 MB
30RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=1.61 GB
31RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=47.94 MB
32ENV UV_HTTP_TIMEOUT=5000 B
33ENV UV_INDEX_STRATEGY=unsafe-best-match0 B
34ENV UV_LINK_MODE=copy0 B
35ENV UV_PYTHON_INSTALL_DIR=/opt/uv/python0 B
36ENV UV_CACHE_DIR=/opt/uv/cache0 B
37RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=150 B
38RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=4.8 KB
39COPY docker/entrypoints/vllm-nonroot-entrypoint.sh /usr/local/bin/vllm-nonroot-entrypoint.sh # buildkit2.03 KB
40RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=2.03 KB
41ENV VLLM_ENABLE_CUDA_COMPATIBILITY=00 B
42ARG PYTORCH_CUDA_INDEX_BASE_URL0 B
43COPY requirements/common.txt /tmp/common.txt # buildkit1.59 KB
44COPY requirements/cuda.txt /tmp/requirements-cuda.txt # buildkit697 B
45RUN |6 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=3.49 GB
46ARG FLASHINFER_VERSION=0.6.11.post20 B
47RUN |7 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=1.74 GB
48ARG GDRCOPY_CUDA_VERSION=12.80 B
49ARG GDRCOPY_OS_VERSION=Ubuntu22_040 B
50ARG TARGETPLATFORM0 B
51COPY tools/install_gdrcopy.sh /tmp/install_gdrcopy.sh # buildkit896 B
52RUN |10 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=524.71 KB
53ARG BITSANDBYTES_VERSION_X86=0.46.10 B
54ARG BITSANDBYTES_VERSION_ARM64=0.42.00 B
55ARG TIMM_VERSION=>=1.0.170 B
56ARG RUNAI_MODEL_STREAMER_VERSION=>=0.15.70 B
57RUN |14 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=115.64 MB
58ARG PIP_INDEX_URL UV_INDEX_URL0 B
59ARG PIP_EXTRA_INDEX_URL UV_EXTRA_INDEX_URL0 B
60ARG PYTORCH_CUDA_INDEX_BASE_URL0 B
61ARG PIP_KEYRING_PROVIDER UV_KEYRING_PROVIDER0 B
62ARG PYTORCH_NIGHTLY0 B
63COPY /workspace/torch_lib_versions.txt torch_lib_versions.txt # buildkit198 B
64RUN |22 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=244.56 MB
65RUN |22 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=32 B
66ENV LD_LIBRARY_PATH=/usr/local/cuda/lib64:/usr/local/nvidia/lib:/usr/local/nvidia/lib64:/usr/local/cuda/lib640 B
67RUN |22 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=11.04 MB
68RUN |22 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=348.42 MB
69ENV LD_LIBRARY_PATH=/usr/local/nvidia/lib64:/usr/local/cuda/lib64:/usr/local/nvidia/lib:/usr/local/nvidia/lib64:/usr/local/cuda/lib640 B
70COPY examples examples # buildkit254.4 KB
71COPY benchmarks benchmarks # buildkit239.51 KB
72COPY ./vllm/collect_env.py . # buildkit9.62 KB
73ARG TARGETPLATFORM0 B
74ARG INSTALL_KV_CONNECTORS=false0 B
75ARG CUDA_VERSION0 B
76ARG VLLM_BUILD_COMMIT0 B
77ARG VLLM_BUILD_PIPELINE0 B
78ARG VLLM_BUILD_URL0 B
79ARG VLLM_IMAGE_TAG0 B
80ARG PIP_INDEX_URL UV_INDEX_URL0 B
81ARG PIP_EXTRA_INDEX_URL UV_EXTRA_INDEX_URL0 B
82ENV UV_HTTP_TIMEOUT=5000 B
83ARG torch_cuda_arch_list=7.5 8.0 8.6 8.90 B
84ENV TORCH_CUDA_ARCH_LIST=7.5 8.0 8.6 8.90 B
85RUN |12 TARGETPLATFORM=linux/amd64 INSTALL_KV_CONNECTORS=true CUDA_VERSION=13.0.2213.38 MB
86ARG MOONCAKE_WHEEL_AARCH640 B
87ARG MOONCAKE_WHEEL_X86_640 B
88RUN |14 TARGETPLATFORM=linux/amd64 INSTALL_KV_CONNECTORS=true CUDA_VERSION=13.0.2460.64 MB
89ENV VLLM_USAGE_SOURCE=production-docker-image0 B
90ENV VLLM_BUILD_COMMIT=0decac0d96c42b49572498019f0a0e3600f50398 VLLM_BUILD_PIPELINE=019d130e-464e-4ff7-b84b-492992c0c06b VLLM_BUILD_URL=https://buildkite.com/vllm/release-v2/builds/2333 VLLM_IMAGE_TAG=vllm/vllm-openai:v0.22.10 B
91LABEL org.opencontainers.image.source=https://github.com/vllm-project/vllm org.opencontainers.image.revision=0decac0d96c42b49572498019f0a0e3600f50398 org.opencontainers.image.version=vllm/vllm-openai:v0.22.1 org.opencontainers.image.url=https://buildkite.com/vllm/release-v2/builds/23330 B
92ENTRYPOINT ["vllm" "serve"]0 B
93ARG SGLANG_VERSION=0.4.80 B
94ARG VLLM_VERSION=0.22.10 B
95ARG CACHEBUST=17811558840 B
96ARG AUTO_UPDATE_LAUNCHER_BASE_URL=https://auto-update-tool.inference.net/dev0 B
97ENV VLLM_NO_USAGE_STATS=10 B
98ENV DEBIAN_FRONTEND=noninteractive0 B
99RUN |4 SGLANG_VERSION=0.4.8 VLLM_VERSION=0.22.1 CACHEBUST=17811558841.45 MB
100RUN |4 SGLANG_VERSION=0.4.8 VLLM_VERSION=0.22.1 CACHEBUST=178115588423.7 MB
101RUN |4 SGLANG_VERSION=0.4.8 VLLM_VERSION=0.22.1 CACHEBUST=17811558843.29 GB
102RUN |4 SGLANG_VERSION=0.4.8 VLLM_VERSION=0.22.1 CACHEBUST=1781155884153 B
103RUN |4 SGLANG_VERSION=0.4.8 VLLM_VERSION=0.22.1 CACHEBUST=178115588432 B
104WORKDIR /app93 B
105RUN |4 SGLANG_VERSION=0.4.8 VLLM_VERSION=0.22.1 CACHEBUST=178115588437.56 MB
106RUN |4 SGLANG_VERSION=0.4.8 VLLM_VERSION=0.22.1 CACHEBUST=178115588437.56 MB
107COPY ./apps/cli/src/lib/chat-templates /app/chat-templates # buildkit4.02 KB
108ARG DOCKER_IMAGE=inference.amd64-node0 B
109ARG DOCKER_IMAGE_TAG=9a306990 B
110ARG AUTO_UPDATE_APP_NAME=inference-cli-linux-amd640 B
111ARG AUTO_UPDATE_LATEST_VERSION_ENDPOINT=https://relay.inference.cool/public/latest-client-version0 B
112ARG AUTO_UPDATE_PUBLIC_BUCKET_URL=https://cfs.inference.cool/auto-update0 B
113ARG CONFIG_DIR=/root/.inference0 B
114ENV IS_RUNNING_IN_DOCKER=true0 B
115ENV SGLANG_VERSION=0.4.80 B
116ENV VLLM_VERSION=0.22.10 B
117ENV DOCKER_IMAGE=inference.amd64-node0 B
118ENV DOCKER_IMAGE_TAG=9a306990 B
119ENV WORKER=0 B
120ENV CODE=0 B
121ENV CONFIG_DIR=/root/.inference0 B
122ENV SGLANG_UV_VENV_PATH=/opt/sglang-venv0 B
123ENV AUTO_UPDATE_APP_NAME=inference-cli-linux-amd640 B
124ENV AUTO_UPDATE_LATEST_VERSION_ENDPOINT=https://relay.inference.cool/public/latest-client-version0 B
125ENV AUTO_UPDATE_PUBLIC_BUCKET_URL=https://cfs.inference.cool/auto-update0 B
126ENTRYPOINT ["./inference-launcher" "node" "start"]0 B

Command

 ARG RELEASE