llm-stack (v0.9.0-rc.3-3)

Published 2026-09-17 19:51:50 +00:00 by beeinger

Installation

docker pull git.energia.dev/beeinger/llm-stack:v0.9.0-rc.3-3
sha256:d342065862d823d2e3a2c59242958e6e9fa421de00c11ad45d30ac8fe3c04f53

Image layers

ARG RELEASE
ARG LAUNCHPAD_BUILD_ARCH
LABEL org.opencontainers.image.ref.name=ubuntu
LABEL org.opencontainers.image.version=24.04
ADD file:e67907c77897d27192314f6c4fa0112b6f7dce3e127500516535cc50fe736c92 in /
CMD ["/bin/bash"]
ENV NVARCH=x86_64
ENV NVIDIA_REQUIRE_CUDA=cuda>=13.0 brand=unknown,driver>=535,driver<536 brand=grid,driver>=535,driver<536 brand=tesla,driver>=535,driver<536 brand=nvidia,driver>=535,driver<536 brand=quadro,driver>=535,driver<536 brand=quadrortx,driver>=535,driver<536 brand=nvidiartx,driver>=535,driver<536 brand=vapps,driver>=535,driver<536 brand=vpc,driver>=535,driver<536 brand=vcs,driver>=535,driver<536 brand=vws,driver>=535,driver<536 brand=cloudgaming,driver>=535,driver<536 brand=unknown,driver>=550,driver<551 brand=grid,driver>=550,driver<551 brand=tesla,driver>=550,driver<551 brand=nvidia,driver>=550,driver<551 brand=quadro,driver>=550,driver<551 brand=quadrortx,driver>=550,driver<551 brand=nvidiartx,driver>=550,driver<551 brand=vapps,driver>=550,driver<551 brand=vpc,driver>=550,driver<551 brand=vcs,driver>=550,driver<551 brand=vws,driver>=550,driver<551 brand=cloudgaming,driver>=550,driver<551 brand=unknown,driver>=565,driver<566 brand=grid,driver>=565,driver<566 brand=tesla,driver>=565,driver<566 brand=nvidia,driver>=565,driver<566 brand=quadro,driver>=565,driver<566 brand=quadrortx,driver>=565,driver<566 brand=nvidiartx,driver>=565,driver<566 brand=vapps,driver>=565,driver<566 brand=vpc,driver>=565,driver<566 brand=vcs,driver>=565,driver<566 brand=vws,driver>=565,driver<566 brand=cloudgaming,driver>=565,driver<566 brand=unknown,driver>=570,driver<571 brand=grid,driver>=570,driver<571 brand=tesla,driver>=570,driver<571 brand=nvidia,driver>=570,driver<571 brand=quadro,driver>=570,driver<571 brand=quadrortx,driver>=570,driver<571 brand=nvidiartx,driver>=570,driver<571 brand=vapps,driver>=570,driver<571 brand=vpc,driver>=570,driver<571 brand=vcs,driver>=570,driver<571 brand=vws,driver>=570,driver<571 brand=cloudgaming,driver>=570,driver<571 brand=unknown,driver>=575,driver<576 brand=grid,driver>=575,driver<576 brand=tesla,driver>=575,driver<576 brand=nvidia,driver>=575,driver<576 brand=quadro,driver>=575,driver<576 brand=quadrortx,driver>=575,driver<576 brand=nvidiartx,driver>=575,driver<576 brand=vapps,driver>=575,driver<576 brand=vpc,driver>=575,driver<576 brand=vcs,driver>=575,driver<576 brand=vws,driver>=575,driver<576 brand=cloudgaming,driver>=575,driver<576
ENV NV_CUDA_CUDART_VERSION=13.0.88-1
ARG TARGETARCH
LABEL maintainer=NVIDIA CORPORATION <cudatools@nvidia.com>
RUN |1 TARGETARCH=amd64 /bin/sh -c apt-get update && apt-get install -y --no-install-recommends gnupg2 curl ca-certificates && curl -fsSL https://developer.download.nvidia.com/compute/cuda/repos/ubuntu2404/${NVARCH}/3bf863cc.pub | apt-key add - && echo "deb https://developer.download.nvidia.com/compute/cuda/repos/ubuntu2404/${NVARCH} /" > /etc/apt/sources.list.d/cuda.list && apt-get purge --autoremove -y curl && rm -rf /var/lib/apt/lists/* # buildkit
ENV CUDA_VERSION=13.0.1
RUN |1 TARGETARCH=amd64 /bin/sh -c apt-get update && apt-get install -y --no-install-recommends cuda-cudart-13-0=${NV_CUDA_CUDART_VERSION} cuda-compat-13-0 && rm -rf /var/lib/apt/lists/* # buildkit
RUN |1 TARGETARCH=amd64 /bin/sh -c echo "/usr/local/cuda/lib64" >> /etc/ld.so.conf.d/nvidia.conf # buildkit
ENV PATH=/usr/local/nvidia/bin:/usr/local/cuda/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin
ENV LD_LIBRARY_PATH=/usr/local/nvidia/lib:/usr/local/nvidia/lib64:/usr/local/cuda/lib64
COPY NGC-DL-CONTAINER-LICENSE / # buildkit
ENV NVIDIA_VISIBLE_DEVICES=all
ENV NVIDIA_DRIVER_CAPABILITIES=compute,utility
ENV NV_CUDA_LIB_VERSION=13.0.1-1
ENV NV_NVTX_VERSION=13.0.85-1
ENV NV_LIBNPP_VERSION=13.0.1.2-1
ENV NV_LIBNPP_PACKAGE=libnpp-13-0=13.0.1.2-1
ENV NV_LIBCUSPARSE_VERSION=12.6.3.3-1
ENV NV_LIBCUBLAS_PACKAGE_NAME=libcublas-13-0
ENV NV_LIBCUBLAS_VERSION=13.0.2.14-1
ENV NV_LIBCUBLAS_PACKAGE=libcublas-13-0=13.0.2.14-1
ENV NV_LIBNCCL_PACKAGE_NAME=libnccl2
ENV NV_LIBNCCL_PACKAGE_VERSION=2.28.3-1
ENV NCCL_VERSION=2.28.3-1
ENV NV_LIBNCCL_PACKAGE=libnccl2=2.28.3-1+cuda13.0
ARG TARGETARCH
LABEL maintainer=NVIDIA CORPORATION <cudatools@nvidia.com>
RUN |1 TARGETARCH=amd64 /bin/sh -c apt-get update && apt-get install -y --no-install-recommends cuda-libraries-13-0=${NV_CUDA_LIB_VERSION} ${NV_LIBNPP_PACKAGE} cuda-nvtx-13-0=${NV_NVTX_VERSION} libcusparse-13-0=${NV_LIBCUSPARSE_VERSION} ${NV_LIBCUBLAS_PACKAGE} ${NV_LIBNCCL_PACKAGE} && rm -rf /var/lib/apt/lists/* # buildkit
RUN |1 TARGETARCH=amd64 /bin/sh -c apt-mark hold ${NV_LIBCUBLAS_PACKAGE_NAME} ${NV_LIBNCCL_PACKAGE_NAME} # buildkit
COPY entrypoint.d/ /opt/nvidia/entrypoint.d/ # buildkit
COPY nvidia_entrypoint.sh /opt/nvidia/ # buildkit
ENV NVIDIA_PRODUCT_NAME=CUDA
ENTRYPOINT ["/opt/nvidia/nvidia_entrypoint.sh"]
ARG SPEACHES_VERSION=v0.9.0-rc.3
ARG S6_VERSION=v3.2.3.2
ARG S6_NOARCH_SHA256=5379750ed30a84bbd2e2dd74847ba6b5bd29cd0b2e3ea2ec58049b57eb2eda12
ARG S6_X86_64_SHA256=e6befcc96a437a3831386ecfc51808c5d3e939dc5fe3c02ae9284599e8aa2408
ENV DEBIAN_FRONTEND=noninteractive
|4 S6_NOARCH_SHA256=5379750ed30a84bbd2e2dd74847ba6b5bd29cd0b2e3ea2ec58049b57eb2eda12 S6_VERSION=v3.2.3.2 S6_X86_64_SHA256=e6befcc96a437a3831386ecfc51808c5d3e939dc5fe3c02ae9284599e8aa2408 SPEACHES_VERSION=v0.9.0-rc.3 /bin/sh -c apt-get update && apt-get install -y --no-install-recommends ca-certificates curl ffmpeg git libgomp1 python3 python3-venv xz-utils && rm -rf /var/lib/apt/lists/*
COPY file:170c7a897b4638b8c2fcc45378fad791f9e70549e1e8df9f25ba62d13368a164 in /usr/local/bin/uv
WORKDIR /opt/speaches
|4 S6_NOARCH_SHA256=5379750ed30a84bbd2e2dd74847ba6b5bd29cd0b2e3ea2ec58049b57eb2eda12 S6_VERSION=v3.2.3.2 S6_X86_64_SHA256=e6befcc96a437a3831386ecfc51808c5d3e939dc5fe3c02ae9284599e8aa2408 SPEACHES_VERSION=v0.9.0-rc.3 /bin/sh -c git clone --depth 1 --branch "${SPEACHES_VERSION}" https://github.com/speaches-ai/speaches.git /opt/speaches && uv sync --frozen --compile-bytecode --no-dev && uv pip install --python .venv/bin/python nvidia-cublas-cu12 nvidia-cudnn-cu12 nvidia-cuda-runtime-cu12
USER root
|4 S6_NOARCH_SHA256=5379750ed30a84bbd2e2dd74847ba6b5bd29cd0b2e3ea2ec58049b57eb2eda12 S6_VERSION=v3.2.3.2 S6_X86_64_SHA256=e6befcc96a437a3831386ecfc51808c5d3e939dc5fe3c02ae9284599e8aa2408 SPEACHES_VERSION=v0.9.0-rc.3 /bin/sh -c find /opt/speaches/.venv -maxdepth 7 -path "*/nvidia/*/lib" -type d > /etc/ld.so.conf.d/venv-nvidia.conf && ldconfig
COPY file:a62bcffeab1a7c2aae3caa36cf93ef54a4e75cd2367099133b680c32a225e4d5 in /opt/speaches/model_aliases.json
|4 S6_NOARCH_SHA256=5379750ed30a84bbd2e2dd74847ba6b5bd29cd0b2e3ea2ec58049b57eb2eda12 S6_VERSION=v3.2.3.2 S6_X86_64_SHA256=e6befcc96a437a3831386ecfc51808c5d3e939dc5fe3c02ae9284599e8aa2408 SPEACHES_VERSION=v0.9.0-rc.3 /bin/sh -c set -eux; curl -fsSL --retry 3 -o /tmp/s6-noarch.tar.xz "https://github.com/just-containers/s6-overlay/releases/download/${S6_VERSION}/s6-overlay-noarch.tar.xz"; curl -fsSL --retry 3 -o /tmp/s6-x86_64.tar.xz "https://github.com/just-containers/s6-overlay/releases/download/${S6_VERSION}/s6-overlay-x86_64.tar.xz"; echo "${S6_NOARCH_SHA256} /tmp/s6-noarch.tar.xz" | sha256sum -c -; echo "${S6_X86_64_SHA256} /tmp/s6-x86_64.tar.xz" | sha256sum -c -; tar -C / -Jxpf /tmp/s6-noarch.tar.xz; tar -C / -Jxpf /tmp/s6-x86_64.tar.xz; rm -f /tmp/s6-*.tar.xz
COPY dir:025882727e9ab2cc2f0fb8219c888f3ff389fa2842f760f4dcae43940e85c39a in /etc/s6-overlay/s6-rc.d/
|4 S6_NOARCH_SHA256=5379750ed30a84bbd2e2dd74847ba6b5bd29cd0b2e3ea2ec58049b57eb2eda12 S6_VERSION=v3.2.3.2 S6_X86_64_SHA256=e6befcc96a437a3831386ecfc51808c5d3e939dc5fe3c02ae9284599e8aa2408 SPEACHES_VERSION=v0.9.0-rc.3 /bin/sh -c find /etc/s6-overlay/s6-rc.d -type f \( -name run -o -name up -o -name script -o -name health-check \) -exec chmod +x {} +
ENV UVICORN_HOST=0.0.0.0 UVICORN_PORT=8000 PATH=/opt/speaches/.venv/bin:/usr/local/sbin:/usr/local/bin:/usr/sbin:/usr/bin:/sbin:/bin HF_HUB_ENABLE_HF_TRANSFER=0 DO_NOT_TRACK=1 GRADIO_ANALYTICS_ENABLED=False DISABLE_TELEMETRY=1 HF_HUB_DISABLE_TELEMETRY=1
EXPOSE 8000 8080
ENTRYPOINT ["/init"]

Labels

Key Value
maintainer NVIDIA CORPORATION <cudatools@nvidia.com>
org.opencontainers.image.ref.name ubuntu
org.opencontainers.image.version 24.04
Details
Container
2026-09-17 19:51:50 +00:00
1
OCI / Docker
linux/amd64
3.7 GiB
Versions (3) View all
v0.9.0-rc.3-3 2026-09-17
v0.9.0-rc.3-2 2026-09-17
v0.9.0-rc.3-1 2026-09-17