# yaml-language-server: $schema=https://schema.zeabur.app/template.json
apiVersion: zeabur.com/v1
kind: Template
metadata:
    name: ACE-Step 1.5
spec:
    description: |
        ACE-Step 1.5 is an open-source music generation foundation model with commercial-grade quality. It features a hybrid LM + DiT architecture supporting text-to-music, lyrics-to-song, audio repainting, covers, and LoRA fine-tuning. Requires GPU with at least 6GB VRAM.
    coverImage: https://raw.githubusercontent.com/ace-step/ACE-Step-1.5/main/assets/ACE-Step_framework.png
    icon: https://raw.githubusercontent.com/ace-step/ACE-Step-1.5/main/assets/acestep_logo.png
    variables:
        - key: PUBLIC_DOMAIN
          type: DOMAIN
          name: Domain
          description: The domain to bind for the service
        - key: ACESTEP_MODE
          type: STRING
          name: Startup Mode
          description: 'Startup mode: gradio (Web UI on port 7860) or api (REST API server on port 8001)'
        - key: ACESTEP_CONFIG_PATH
          type: STRING
          name: DiT Model
          description: 'DiT model config to use: acestep-v15-base, acestep-v15-sft, acestep-v15-turbo, or acestep-v15-turbo-rl'
        - key: ACESTEP_LM_MODEL_PATH
          type: STRING
          name: LM Model
          description: 'Language Model to use: acestep-5Hz-lm-0.6B, acestep-5Hz-lm-1.7B, or acestep-5Hz-lm-4B. Leave empty for DiT-only mode.'
        - key: ACESTEP_API_KEY
          type: STRING
          name: API Key
          description: Optional API authentication key for the REST API. Leave empty for no authentication.
    tags:
        - AI
        - Music
        - GPU
    readme: |
        # ACE-Step 1.5

        ACE-Step 1.5 is an open-source music generation foundation model developed by StepFun & ACE Studio. It combines a Language Model (LM) planner with a Diffusion Transformer (DiT) to produce commercial-grade music.

        ## Features

        - **Text-to-Music**: Generate music from text descriptions (genre, mood, BPM, key, etc.)
        - **Lyrics-to-Song**: Generate songs from structured lyrics with timestamps
        - **Audio Repainting**: Edit specific sections of existing audio
        - **Audio Continuation**: Extend existing audio clips
        - **LoRA Training**: Fine-tune with your own audio data

        ## Startup Mode

        Set `ACESTEP_MODE` to choose the service to launch:

        | Mode | Port | Description |
        |------|------|-------------|
        | `gradio` (default) | 7860 | Interactive Gradio Web UI for music generation |
        | `api` | 8001 | REST API server for programmatic access (`/generate`, `/health`) |

        ## GPU Requirements

        | VRAM | Mode | LM Model |
        |------|------|----------|
        | 6 GB | DiT-only (no LM) | None |
        | 6-8 GB | DiT + LM | `acestep-5Hz-lm-0.6B` |
        | 8-16 GB | DiT + LM | `acestep-5Hz-lm-1.7B` |
        | 16+ GB | DiT + LM | `acestep-5Hz-lm-4B` |

        ## Configuration

        - **ACESTEP_MODE**: Startup mode — `gradio` (Web UI) or `api` (REST API server)
        - **ACESTEP_CONFIG_PATH**: DiT model variant (default: `acestep-v15-turbo`)
        - **ACESTEP_LM_MODEL_PATH**: LM model size (default: `acestep-5Hz-lm-1.7B`)
        - **ACESTEP_LLM_BACKEND**: LLM backend — `vllm` (faster, needs 8GB+) or `pt` (PyTorch fallback)
        - **ACESTEP_API_KEY**: Optional API authentication key

        ## Links

        - [GitHub Repository](https://github.com/ace-step/ACE-Step-1.5)
        - [Model Zoo](https://github.com/ace-step/ACE-Step-1.5#model-zoo)
        - [API Documentation](https://github.com/ace-step/ACE-Step-1.5/tree/main/docs)
    resourceRequirement:
        minConfig:
            cpu: 4
            ram: 16
        recommendedConfig:
            cpu: 8
            ram: 32
    services:
        - name: acestep
          icon: https://raw.githubusercontent.com/ace-step/ACE-Step-1.5/main/assets/acestep_logo.png
          template: PREBUILT_V2
          spec:
            id: acestep
            source:
                image: ghcr.io/ace-step/ace-step-1.5:v0.1.0
            ports:
                - id: web
                  port: 7860
                  type: HTTP
                - id: api
                  port: 8001
                  type: HTTP
            volumes:
                - id: checkpoints
                  dir: /app/checkpoints
                - id: outputs
                  dir: /app/gradio_outputs
                - id: hf-cache
                  dir: /root/.cache/huggingface
            env:
                ACESTEP_API_HOST:
                    default: 0.0.0.0
                ACESTEP_API_KEY:
                    default: ${ACESTEP_API_KEY}
                ACESTEP_API_PORT:
                    default: "8001"
                ACESTEP_CONFIG_PATH:
                    default: ${ACESTEP_CONFIG_PATH:-acestep-v15-turbo}
                ACESTEP_INIT_SERVICE:
                    default: "true"
                ACESTEP_LLM_BACKEND:
                    default: vllm
                ACESTEP_LM_MODEL_PATH:
                    default: ${ACESTEP_LM_MODEL_PATH:-acestep-5Hz-lm-1.7B}
                ACESTEP_MODE:
                    default: ${ACESTEP_MODE:-gradio}
                GRADIO_PORT:
                    default: "7860"
                GRADIO_SERVER_NAME:
                    default: 0.0.0.0
                NVIDIA_VISIBLE_DEVICES:
                    default: all
                TOKENIZERS_PARALLELISM:
                    default: "false"
          domainKey:
            - port: web
              variable: PUBLIC_DOMAIN
localization:
    es-ES:
        description: |
            ACE-Step 1.5 es un modelo fundacional de generación musical de código abierto con calidad comercial. Presenta una arquitectura híbrida LM + DiT que soporta texto a música, letras a canciones, repintado de audio, covers y ajuste fino con LoRA. Requiere GPU con al menos 6GB de VRAM.
        variables:
            - key: PUBLIC_DOMAIN
              type: STRING
              name: Dominio
              description: El dominio para vincular al servicio
            - key: ACESTEP_MODE
              type: STRING
              name: Modo de Inicio
              description: 'Modo de inicio: gradio (interfaz web, puerto 7860) o api (servidor REST API, puerto 8001)'
            - key: ACESTEP_CONFIG_PATH
              type: STRING
              name: Modelo DiT
              description: 'Configuración del modelo DiT: acestep-v15-base, acestep-v15-sft, acestep-v15-turbo o acestep-v15-turbo-rl'
            - key: ACESTEP_LM_MODEL_PATH
              type: STRING
              name: Modelo de Lenguaje
              description: 'Modelo de lenguaje: acestep-5Hz-lm-0.6B, acestep-5Hz-lm-1.7B o acestep-5Hz-lm-4B. Dejar vacío para modo solo DiT.'
            - key: ACESTEP_API_KEY
              type: STRING
              name: Clave API
              description: Clave de autenticación opcional para la API REST. Dejar vacío para sin autenticación.
        readme: |
            # ACE-Step 1.5

            ACE-Step 1.5 es un modelo fundacional de generación musical de código abierto desarrollado por StepFun y ACE Studio. Combina un planificador de Modelo de Lenguaje (LM) con un Transformer de Difusión (DiT) para producir música de calidad comercial.

            ## Características

            - **Texto a Música**: Genera música a partir de descripciones de texto (género, estado de ánimo, BPM, tonalidad, etc.)
            - **Letras a Canción**: Genera canciones a partir de letras estructuradas
            - **Repintado de Audio**: Edita secciones específicas de audio existente
            - **Continuación de Audio**: Extiende clips de audio existentes
            - **Entrenamiento LoRA**: Ajusta fino con tus propios datos de audio

            ## Modo de Inicio

            Configure `ACESTEP_MODE` para elegir el servicio a iniciar:

            | Modo | Puerto | Descripción |
            |------|--------|-------------|
            | `gradio` (predeterminado) | 7860 | Interfaz web interactiva Gradio |
            | `api` | 8001 | Servidor REST API (`/generate`, `/health`) |

            ## Requisitos de GPU

            | VRAM | Modo | Modelo LM |
            |------|------|-----------|
            | 6 GB | Solo DiT (sin LM) | Ninguno |
            | 6-8 GB | DiT + LM | `acestep-5Hz-lm-0.6B` |
            | 8-16 GB | DiT + LM | `acestep-5Hz-lm-1.7B` |
            | 16+ GB | DiT + LM | `acestep-5Hz-lm-4B` |

            ## Enlaces

            - [Repositorio GitHub](https://github.com/ace-step/ACE-Step-1.5)
    id-ID:
        description: |
            ACE-Step 1.5 adalah model dasar generasi musik open-source dengan kualitas komersial. Menampilkan arsitektur hibrida LM + DiT yang mendukung teks-ke-musik, lirik-ke-lagu, audio repainting, cover, dan fine-tuning LoRA. Membutuhkan GPU dengan minimal 6GB VRAM.
        variables:
            - key: PUBLIC_DOMAIN
              type: STRING
              name: Domain
              description: Domain untuk diikat ke layanan
            - key: ACESTEP_MODE
              type: STRING
              name: Mode Startup
              description: 'Mode startup: gradio (antarmuka web, port 7860) atau api (server REST API, port 8001)'
            - key: ACESTEP_CONFIG_PATH
              type: STRING
              name: Model DiT
              description: 'Konfigurasi model DiT: acestep-v15-base, acestep-v15-sft, acestep-v15-turbo, atau acestep-v15-turbo-rl'
            - key: ACESTEP_LM_MODEL_PATH
              type: STRING
              name: Model Bahasa
              description: 'Model bahasa: acestep-5Hz-lm-0.6B, acestep-5Hz-lm-1.7B, atau acestep-5Hz-lm-4B. Kosongkan untuk mode DiT saja.'
            - key: ACESTEP_API_KEY
              type: STRING
              name: Kunci API
              description: Kunci autentikasi opsional untuk REST API. Kosongkan untuk tanpa autentikasi.
        readme: |
            # ACE-Step 1.5

            ACE-Step 1.5 adalah model dasar generasi musik open-source yang dikembangkan oleh StepFun & ACE Studio. Menggabungkan perencana Model Bahasa (LM) dengan Diffusion Transformer (DiT) untuk menghasilkan musik berkualitas komersial.

            ## Fitur

            - **Teks ke Musik**: Menghasilkan musik dari deskripsi teks (genre, suasana, BPM, kunci, dll.)
            - **Lirik ke Lagu**: Menghasilkan lagu dari lirik terstruktur
            - **Audio Repainting**: Mengedit bagian tertentu dari audio yang ada
            - **Kelanjutan Audio**: Memperpanjang klip audio yang ada
            - **Pelatihan LoRA**: Fine-tune dengan data audio Anda sendiri

            ## Mode Startup

            Atur `ACESTEP_MODE` untuk memilih layanan yang dijalankan:

            | Mode | Port | Deskripsi |
            |------|------|-----------|
            | `gradio` (default) | 7860 | Antarmuka web interaktif Gradio |
            | `api` | 8001 | Server REST API (`/generate`, `/health`) |

            ## Persyaratan GPU

            | VRAM | Mode | Model LM |
            |------|------|----------|
            | 6 GB | DiT saja (tanpa LM) | Tidak ada |
            | 6-8 GB | DiT + LM | `acestep-5Hz-lm-0.6B` |
            | 8-16 GB | DiT + LM | `acestep-5Hz-lm-1.7B` |
            | 16+ GB | DiT + LM | `acestep-5Hz-lm-4B` |

            ## Tautan

            - [Repositori GitHub](https://github.com/ace-step/ACE-Step-1.5)
    ja-JP:
        description: |
            ACE-Step 1.5 は商用品質のオープンソース音楽生成基盤モデルです。LM + DiT ハイブリッドアーキテクチャを採用し、テキストからの音楽生成、歌詞からの楽曲生成、オーディオリペイント、カバー、LoRA ファインチューニングに対応。最低 6GB VRAM の GPU が必要です。
        variables:
            - key: PUBLIC_DOMAIN
              type: STRING
              name: ドメイン
              description: サービスにバインドするドメイン
            - key: ACESTEP_MODE
              type: STRING
              name: 起動モード
              description: 起動モード：gradio（Web UI、ポート 7860）または api（REST API サーバー、ポート 8001）
            - key: ACESTEP_CONFIG_PATH
              type: STRING
              name: DiT モデル
              description: 使用する DiT モデル設定：acestep-v15-base、acestep-v15-sft、acestep-v15-turbo、または acestep-v15-turbo-rl
            - key: ACESTEP_LM_MODEL_PATH
              type: STRING
              name: 言語モデル
              description: 使用する言語モデル：acestep-5Hz-lm-0.6B、acestep-5Hz-lm-1.7B、または acestep-5Hz-lm-4B。空にすると DiT のみモード。
            - key: ACESTEP_API_KEY
              type: STRING
              name: API キー
              description: REST API のオプション認証キー。空にすると認証なし。
        readme: |
            # ACE-Step 1.5

            ACE-Step 1.5 は StepFun と ACE Studio が開発したオープンソースの音楽生成基盤モデルです。言語モデル（LM）プランナーと拡散 Transformer（DiT）を組み合わせ、商用品質の音楽を生成します。

            ## 機能

            - **テキストから音楽生成**：テキスト記述から音楽を生成（ジャンル、ムード、BPM、キーなど）
            - **歌詞から楽曲生成**：構造化された歌詞から完全な楽曲を生成
            - **オーディオリペイント**：既存オーディオの特定セクションを編集
            - **オーディオ継続**：既存オーディオクリップを延長
            - **LoRA トレーニング**：独自のオーディオデータでファインチューニング

            ## 起動モード

            `ACESTEP_MODE` を設定して起動するサービスを選択：

            | モード | ポート | 説明 |
            |--------|--------|------|
            | `gradio`（デフォルト） | 7860 | インタラクティブな Gradio ウェブ UI |
            | `api` | 8001 | REST API サーバー（`/generate`、`/health`） |

            ## GPU 要件

            | VRAM | モード | 言語モデル |
            |------|--------|------------|
            | 6 GB | DiT のみ（LM なし） | なし |
            | 6-8 GB | DiT + LM | `acestep-5Hz-lm-0.6B` |
            | 8-16 GB | DiT + LM | `acestep-5Hz-lm-1.7B` |
            | 16+ GB | DiT + LM | `acestep-5Hz-lm-4B` |

            ## リンク

            - [GitHub リポジトリ](https://github.com/ace-step/ACE-Step-1.5)
    zh-CN:
        description: |
            ACE-Step 1.5 是一款开源音乐生成基础模型，具有商业级品质。采用 LM + DiT 混合架构，支持文字生成音乐、歌词生成歌曲、音频重绘、翻唱和 LoRA 微调。需要至少 6GB 显存的 GPU。
        variables:
            - key: PUBLIC_DOMAIN
              type: STRING
              name: 域名
              description: 绑定到服务的域名
            - key: ACESTEP_MODE
              type: STRING
              name: 启动模式
              description: 启动模式：gradio（网页界面，端口 7860）或 api（REST API 服务器，端口 8001）
            - key: ACESTEP_CONFIG_PATH
              type: STRING
              name: DiT 模型
              description: 使用的 DiT 模型配置：acestep-v15-base、acestep-v15-sft、acestep-v15-turbo 或 acestep-v15-turbo-rl
            - key: ACESTEP_LM_MODEL_PATH
              type: STRING
              name: 语言模型
              description: 使用的语言模型：acestep-5Hz-lm-0.6B、acestep-5Hz-lm-1.7B 或 acestep-5Hz-lm-4B。留空则使用纯 DiT 模式。
            - key: ACESTEP_API_KEY
              type: STRING
              name: API 密钥
              description: REST API 的可选认证密钥。留空表示不需要认证。
        readme: |
            # ACE-Step 1.5

            ACE-Step 1.5 是由阶跃星辰与 ACE Studio 开发的开源音乐生成基础模型。结合语言模型（LM）规划器与扩散 Transformer（DiT），产生商业级品质的音乐。

            ## 功能特色

            - **文字生音乐**：从文字描述生成音乐（风格、情绪、BPM、调性等）
            - **歌词生歌曲**：从结构化歌词生成完整歌曲
            - **音频重绘**：编辑现有音频的特定段落
            - **音频延续**：延展现有音频片段
            - **LoRA 训练**：使用自己的音频数据微调模型

            ## 启动模式

            设置 `ACESTEP_MODE` 选择启动的服务：

            | 模式 | 端口 | 说明 |
            |------|------|------|
            | `gradio`（默认） | 7860 | 交互式 Gradio 网页界面 |
            | `api` | 8001 | REST API 服务器（`/generate`、`/health`） |

            ## GPU 需求

            | 显存 | 模式 | 语言模型 |
            |------|------|----------|
            | 6 GB | 纯 DiT（无 LM） | 无 |
            | 6-8 GB | DiT + LM | `acestep-5Hz-lm-0.6B` |
            | 8-16 GB | DiT + LM | `acestep-5Hz-lm-1.7B` |
            | 16+ GB | DiT + LM | `acestep-5Hz-lm-4B` |

            ## 链接

            - [GitHub 仓库](https://github.com/ace-step/ACE-Step-1.5)
    zh-TW:
        description: |
            ACE-Step 1.5 是一款開源音樂生成基礎模型，具有商業級品質。採用 LM + DiT 混合架構，支援文字生成音樂、歌詞生成歌曲、音訊重繪、翻唱和 LoRA 微調。需要至少 6GB 顯存的 GPU。
        variables:
            - key: PUBLIC_DOMAIN
              type: STRING
              name: 網域
              description: 綁定到服務的網域
            - key: ACESTEP_MODE
              type: STRING
              name: 啟動模式
              description: 啟動模式：gradio（網頁介面，埠號 7860）或 api（REST API 伺服器，埠號 8001）
            - key: ACESTEP_CONFIG_PATH
              type: STRING
              name: DiT 模型
              description: 使用的 DiT 模型設定：acestep-v15-base、acestep-v15-sft、acestep-v15-turbo 或 acestep-v15-turbo-rl
            - key: ACESTEP_LM_MODEL_PATH
              type: STRING
              name: 語言模型
              description: 使用的語言模型：acestep-5Hz-lm-0.6B、acestep-5Hz-lm-1.7B 或 acestep-5Hz-lm-4B。留空則使用純 DiT 模式。
            - key: ACESTEP_API_KEY
              type: STRING
              name: API 金鑰
              description: REST API 的可選驗證金鑰。留空表示不需要驗證。
        readme: |
            # ACE-Step 1.5

            ACE-Step 1.5 是由階躍星辰與 ACE Studio 開發的開源音樂生成基礎模型。結合語言模型（LM）規劃器與擴散 Transformer（DiT），產生商業級品質的音樂。

            ## 功能特色

            - **文字生音樂**：從文字描述生成音樂（風格、情緒、BPM、調性等）
            - **歌詞生歌曲**：從結構化歌詞生成完整歌曲
            - **音訊重繪**：編輯現有音訊的特定段落
            - **音訊延續**：延展現有音訊片段
            - **LoRA 訓練**：使用自己的音訊資料微調模型

            ## 啟動模式

            設定 `ACESTEP_MODE` 選擇啟動的服務：

            | 模式 | 埠號 | 說明 |
            |------|------|------|
            | `gradio`（預設） | 7860 | 互動式 Gradio 網頁介面 |
            | `api` | 8001 | REST API 伺服器（`/generate`、`/health`） |

            ## GPU 需求

            | 顯存 | 模式 | 語言模型 |
            |------|------|----------|
            | 6 GB | 純 DiT（無 LM） | 無 |
            | 6-8 GB | DiT + LM | `acestep-5Hz-lm-0.6B` |
            | 8-16 GB | DiT + LM | `acestep-5Hz-lm-1.7B` |
            | 16+ GB | DiT + LM | `acestep-5Hz-lm-4B` |

            ## 連結

            - [GitHub 倉庫](https://github.com/ace-step/ACE-Step-1.5)
