sha256:996d155393399e4b18efe45c92061f6900d6f1f8864a6924d643ea1579b4560e
OS/ARCH
linux/amd64
Compressed size
8.57 GB
Last pushed
4 months by themrtoadog
Type
Image
Manifest digest
sha256:996d155393399e4b18efe45c92061f6900d6f1f8864a6924d643ea1579b4560e
Image Layers
1ARG RELEASE0 B2ARG LAUNCHPAD_BUILD_ARCH0 B3LABEL org.opencontainers.image.ref.name=ubuntu0 B4LABEL org.opencontainers.image.version=22.040 B5ADD file ... in / 29.04 MB6CMD ["/bin/bash"]0 B7ENV NVARCH=x86_640 B8ENV NVIDIA_REQUIRE_CUDA=cuda>=13.0 brand=unknown,driver>=535,driver<536 brand=grid,driver>=535,driver<536 brand=tesla,driver>=535,driver<5360 B9ENV NV_CUDA_CUDART_VERSION=13.0.96-10 B10ARG TARGETARCH0 B12RUN |1 TARGETARCH=amd64 /bin/sh -c4.43 MB13ENV CUDA_VERSION=13.0.20 B14RUN |1 TARGETARCH=amd64 /bin/sh -c100.3 MB15RUN |1 TARGETARCH=amd64 /bin/sh -c185 B16ENV PATH=/usr/local/nvidia/bin:/usr/local/cuda/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin0 B17ENV LD_LIBRARY_PATH=/usr/local/nvidia/lib:/usr/local/nvidia/lib64:/usr/local/cuda/lib640 B18COPY NGC-DL-CONTAINER-LICENSE / # buildkit6.72 KB19ENV NVIDIA_VISIBLE_DEVICES=all0 B20ENV NVIDIA_DRIVER_CAPABILITIES=compute,utility0 B21ARG CUDA_VERSION0 B22ARG PYTHON_VERSION0 B23ARG DEADSNAKES_MIRROR_URL0 B24ARG DEADSNAKES_GPGKEY_URL0 B25ARG GET_PIP_URL0 B26ENV DEBIAN_FRONTEND=noninteractive0 B27WORKDIR /vllm-workspace104 B28RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=230 B29RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=214.05 MB30RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=1.61 GB31RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=48.39 MB32ENV UV_HTTP_TIMEOUT=5000 B33ENV UV_INDEX_STRATEGY=unsafe-best-match0 B34ENV UV_LINK_MODE=copy0 B35ENV UV_PYTHON_INSTALL_DIR=/opt/uv/python0 B36ENV UV_CACHE_DIR=/opt/uv/cache0 B37RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=151 B38RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=4.8 KB39COPY docker/entrypoints/vllm-nonroot-entrypoint.sh /usr/local/bin/vllm-nonroot-entrypoint.sh # buildkit2.03 KB40RUN |5 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=2.03 KB41ENV VLLM_ENABLE_CUDA_COMPATIBILITY=00 B42ARG PYTORCH_CUDA_INDEX_BASE_URL0 B43COPY requirements/common.txt /tmp/common.txt # buildkit1.58 KB44COPY requirements/cuda.txt /tmp/requirements-cuda.txt # buildkit648 B45RUN |6 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=3.6 GB46ARG FLASHINFER_VERSION=0.6.120 B47RUN |7 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=1.44 GB48ARG GDRCOPY_CUDA_VERSION=12.80 B49ARG GDRCOPY_OS_VERSION=Ubuntu22_040 B50ARG TARGETPLATFORM0 B51COPY tools/install_gdrcopy.sh /tmp/install_gdrcopy.sh # buildkit895 B52RUN |10 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=524.67 KB53ARG BITSANDBYTES_VERSION_X86=0.46.10 B54ARG BITSANDBYTES_VERSION_ARM64=0.42.00 B55ARG TIMM_VERSION=>=1.0.170 B56ARG RUNAI_MODEL_STREAMER_VERSION=>=0.15.70 B57RUN |14 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=115.7 MB58ARG PIP_INDEX_URL UV_INDEX_URL0 B59ARG PIP_EXTRA_INDEX_URL UV_EXTRA_INDEX_URL0 B60ARG PYTORCH_CUDA_INDEX_BASE_URL0 B61ARG PIP_KEYRING_PROVIDER UV_KEYRING_PROVIDER0 B62ARG PYTORCH_NIGHTLY0 B63COPY /workspace/torch_lib_versions.txt torch_lib_versions.txt # buildkit198 B64RUN |22 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=256.87 MB65RUN |22 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=32 B66ENV LD_LIBRARY_PATH=/usr/local/cuda/lib64:/usr/local/nvidia/lib:/usr/local/nvidia/lib64:/usr/local/cuda/lib640 B67RUN |22 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=11.04 MB68RUN |22 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=76.7 MB69RUN |22 CUDA_VERSION=13.0.2 PYTHON_VERSION=3.12 DEADSNAKES_MIRROR_URL=429.91 MB70ENV LD_LIBRARY_PATH=/usr/local/nvidia/lib64:/usr/local/cuda/lib64:/usr/local/nvidia/lib:/usr/local/nvidia/lib64:/usr/local/cuda/lib640 B71COPY examples examples # buildkit257.85 KB72COPY benchmarks benchmarks # buildkit240.82 KB73COPY ./vllm/collect_env.py . # buildkit9.62 KB74ARG TARGETPLATFORM0 B75ARG INSTALL_KV_CONNECTORS=false0 B76ARG CUDA_VERSION0 B77ARG VLLM_BUILD_COMMIT0 B78ARG VLLM_BUILD_PIPELINE0 B79ARG VLLM_BUILD_URL0 B80ARG VLLM_IMAGE_TAG0 B81ARG PIP_INDEX_URL UV_INDEX_URL0 B82ARG PIP_EXTRA_INDEX_URL UV_EXTRA_INDEX_URL0 B83ENV UV_HTTP_TIMEOUT=5000 B84ARG torch_cuda_arch_list=7.5 8.0 8.6 8.90 B85ENV TORCH_CUDA_ARCH_LIST=7.5 8.0 8.6 8.90 B86RUN |12 TARGETPLATFORM=linux/amd64 INSTALL_KV_CONNECTORS=true CUDA_VERSION=13.0.2213.38 MB87ARG MOONCAKE_WHEEL_AARCH640 B88ARG MOONCAKE_WHEEL_X86_640 B89RUN |14 TARGETPLATFORM=linux/amd64 INSTALL_KV_CONNECTORS=true CUDA_VERSION=13.0.2460.65 MB90ENV VLLM_USAGE_SOURCE=production-docker-image0 B91ENV VLLM_BUILD_COMMIT=91df0fad4dc98a67c7659d9dbd915245d5c43d96 VLLM_BUILD_PIPELINE=019d130e-464e-4ff7-b84b-492992c0c06b VLLM_BUILD_URL=https://buildkite.com/vllm/release-v2/builds/2657 VLLM_IMAGE_TAG=vllm/vllm-openai:v0.23.00 B92LABEL org.opencontainers.image.source=https://github.com/vllm-project/vllm org.opencontainers.image.revision=91df0fad4dc98a67c7659d9dbd915245d5c43d96 org.opencontainers.image.version=vllm/vllm-openai:v0.23.0 org.opencontainers.image.url=https://buildkite.com/vllm/release-v2/builds/26570 B93ENTRYPOINT ["vllm" "serve"]0 B94ARG LILAC_VLLM_REVISION=b049e01e82f7ea19efec79dd3dd08f867d446eaf0 B95ARG TRANSFORMERS_SPEC=transformers>=5.9.00 B96LABEL org.opencontainers.image.source=https://github.com/getlilac/vllm0 B97LABEL org.opencontainers.image.revision=b049e01e82f7ea19efec79dd3dd08f867d446eaf0 B98LABEL org.opencontainers.image.description=Lilac vLLM 0.23 GLM0 B99RUN |2 LILAC_VLLM_REVISION=b049e01e82f7ea19efec79dd3dd08f867d446eaf TRANSFORMERS_SPEC=transformers>=5.9.0 /bin/sh32 B100COPY vllm/entrypoints/openai/chat_completion/serving.py /tmp/lilac-vllm-overlay/vllm/entrypoints/openai/chat_completion/serving.py # buildkit11.79 KB101COPY vllm/model_executor/layers/attention/mla_attention.py /tmp/lilac-vllm-overlay/vllm/model_executor/layers/attention/mla_attention.py # buildkit20.21 KB102COPY vllm/model_executor/layers/mla.py /tmp/lilac-vllm-overlay/vllm/model_executor/layers/mla.py # buildkit2.02 KB103COPY vllm/model_executor/models/deepseek_mtp.py /tmp/lilac-vllm-overlay/vllm/model_executor/models/deepseek_mtp.py # buildkit5.13 KB104COPY vllm/model_executor/models/deepseek_v2.py /tmp/lilac-vllm-overlay/vllm/model_executor/models/deepseek_v2.py # buildkit14.18 KB105COPY vllm/parser /tmp/lilac-vllm-overlay/vllm/parser # buildkit32.26 KB106COPY vllm/reasoning /tmp/lilac-vllm-overlay/vllm/reasoning # buildkit32.79 KB107COPY vllm/tool_parsers /tmp/lilac-vllm-overlay/vllm/tool_parsers # buildkit131.17 KB108COPY vllm/v1/attention/backends/mla/flashinfer_mla_sparse.py /tmp/lilac-vllm-overlay/vllm/v1/attention/backends/mla/flashinfer_mla_sparse.py # buildkit3.76 KB109COPY vllm/v1/attention/backends/mla/flashmla_sparse.py /tmp/lilac-vllm-overlay/vllm/v1/attention/backends/mla/flashmla_sparse.py # buildkit8.3 KB110COPY vllm/v1/attention/backends/mla/rocm_aiter_mla_sparse.py /tmp/lilac-vllm-overlay/vllm/v1/attention/backends/mla/rocm_aiter_mla_sparse.py # buildkit7.19 KB111COPY vllm/v1/attention/backends/mla/xpu_mla_sparse.py /tmp/lilac-vllm-overlay/vllm/v1/attention/backends/mla/xpu_mla_sparse.py # buildkit2.74 KB112COPY vllm/v1/attention/backends/mla/prefill /tmp/lilac-vllm-overlay/vllm/v1/attention/backends/mla/prefill # buildkit8 KB113COPY vllm/v1/spec_decode/llm_base_proposer.py /tmp/lilac-vllm-overlay/vllm/v1/spec_decode/llm_base_proposer.py # buildkit16.92 KB114RUN |2 LILAC_VLLM_REVISION=b049e01e82f7ea19efec79dd3dd08f867d446eaf TRANSFORMERS_SPEC=transformers>=5.9.0 /bin/sh14.72 MBCommand
ARG RELEASE