# 0004 — Modell-Connector gegen OpenAI-kompatible API, kein Spike nötig - **Status:** accepted (ersetzt: 2026-06-03, vorherige Version sah Spike vor) - **Kontext:** Der selbst gehostete Modell-Server (Jetson Orin Nano Super) ist ein **externer Dienst** außerhalb dieses Repos. Das Backend (Ollama, llama.cpp, vLLM o. ä.) ist Sache des Betreibers, nicht dieses Projekts. - **Entscheidung:** Der Connector (F-05) portiert gegen die **OpenAI Chat Completions API** (`POST /v1/chat/completions`). Das ist der de-facto-Standard für selbst gehostete Modelle. Die Basis-URL wird via Env-Var `MODEL_BASE_URL` konfiguriert. Kein Spike nötig — die API-Spec ist bekannt und stabil. - **Gründe:** - Ollama, llama.cpp-HTTP, vLLM und LiteLLM exponieren alle diese Schnittstelle. - Der Connector funktioniert mit jedem Backend, das sich daran hält. - Ein Spike wäre nur nötig, wenn das API-Format unbekannt wäre — das ist hier nicht der Fall. - **Konsequenz:** Wenn der externe Server ein nicht-kompatibles Format hat, ist das ein Ops-Problem, kein Code-Problem. F-05 dokumentiert das erwartete Schema im Manifest (R-0006).