文字
GGUF 走 llama-server。safetensors 走 vLLM。內建 echo 只作協議測試,不代表真實模型。
YSK Omni 是本機 Hugging Face 模型前面的 OpenAI 相容閘道。文字由 llama-server 或 vLLM 承擔;圖像、語音、轉錄與影片交給您另行指定的 worker。
客戶端 Authorization: Bearer omni_live_…
│
Express 閘道 :3850
├─ GGUF → llama-server
├─ safetensors → vLLM
├─ echo → 內建協議測試
└─ 圖像/語音/轉錄/影片 → 獨立 worker
閘道不會啟動外部編程 CLI。若您要包裝的是本機 Grok 命令列,請看 Grok CLI Gateway。
在管理台的目錄拉取 GGUF 或 Hub 快照,再 Load。已載入的 GGUF 由 llama-server 持續提供對話。
GGUF 走 llama-server。safetensors 走 vLLM。內建 echo 只作協議測試,不代表真實模型。
分別指向 OMNI_IMAGE_URL、OMNI_TTS_URL、OMNI_STT_URL。未設定時,請求回 501 engine_unconfigured。
OMNI_VIDEO_URL 指向 OpenAI 形狀的 worker。未設定時,閘道可能只回一段短 H.264 樣本,並非正式生成。
基底網址 http://127.0.0.1:3850。金鑰可限制可用模型;空白清單代表目錄內全部模型。
curl -sS http://127.0.0.1:3850/v1/models \
-H "Authorization: Bearer omni_live_…"
curl -sS http://127.0.0.1:3850/v1/chat/completions \
-H "Authorization: Bearer omni_live_…" \
-H "Content-Type: application/json" \
-d '{"model":"echo","messages":[{"role":"user","content":"你好"}]}'
POST /v1/chat/completions — 可 stream: truePOST /v1/responses — OpenAI Responses 文字子集POST /v1/messages — Anthropic Messages,亦接受 x-api-key/v1/images/*、/v1/videos、/v1/audio/speech、/v1/audio/transcriptionsGET /health 與 GET /ready開啟管理台用一次性登入碼,不是把 omni_live_… 貼進瀏覽器。
對話以 AES-256-GCM 寫入 SQLite(~/.ysk-omni/data/gateway.db)。權重放在 models/。
金鑰可限定模型。圖像、影片與語音需要 agent 或 admin 金鑰,除非操作者正以管理台一次性碼登入。
超過限額回 429。佇列已滿或正在排空時,分別回 429 或 503。
需要 Node.js 20 或以上。完整手冊見倉庫 docs/zh。
npm install -g ysk-omni
ysk-omni setup
ysk-omni admin otp
ysk-omni start
# http://127.0.0.1:3850/admin/
此頁不標價。企業若要代為安裝、接上媒體 worker,或按環境訂造,由 YSK Limited 按範圍書面報價。
直接答案:是。MIT 開源,可自行安裝使用。YSK Limited 不向開源使用收費。
直接答案:Grok CLI Gateway 包裝本機 Grok 命令列。YSK Omni 跑本機 Hugging Face 權重,文字用 llama-server 或 vLLM。
直接答案:預設連接埠 3850。命令列為 ysk-omni,短名 ysko。管理台以一次性登入碼開啟。
直接答案:圖像、語音與轉錄會回 501。未設定影片 worker 時,可能只回一段短 H.264 樣本,並非正式影片生成。