IDE Integration
Nutze mittwalds DSGVO-konforme KI-Modelle direkt in deiner Entwicklungsumgebung für Code-Generierung, Vervollständigung, Refactoring und Debugging. Alle Modelle werden in Deutschland gehostet, ohne Nutzerdaten zu speichern oder zum Training zu verwenden.
Verfügbare Modelle
Der Service bietet mehrere Modelle für unterschiedliche Entwicklungsaufgaben. Eine vollständige Liste findest du in der Dokumentation zu KI-Modellen.
Empfohlene Modelle:
- Qwen3.5-122B-A10B-FP8: Standardwahl für Coding – stärkstes Tool Calling, 245.760 Token Kontext
- Qwen3.8-27B-NVFP4: schneller als das 122B-Modell, 256.000 Token Kontext
- Qwen3.6-35B-A3B-FP8: das schnellste der drei, 256.000 Token Kontext, gut für Completion und schnelle Edits
- gpt-oss-120b: reasoning-lastige Aufgaben, 131.072 Token Kontext
- Ministral-3-14B-Instruct-2512: klein und schnell, 262.144 Token Kontext, für leichtgewichtige Assistenten
Unterstützte IDEs und Tools
| IDE/Tool | Integrationen |
|---|---|
| JetBrains IDEs (IntelliJ, PHPStorm, ...) | JetBrains AI, Continue |
| Visual Studio Code | Continue, Cline, Kilo Code |
| Cursor | Cline |
| Windsurf | Cline |
| Zed | Zed |
Läuft dein Agent lieber im Terminal statt im Editor? Unter CLI Agents findest du Hermes Agent, Pi und opencode.
Schnellstart
- AI-Hosting-API-Key holen: Siehe API-Key einrichten
- IDE wählen: Eine der Integrationen oben nutzen
- Endpoint konfigurieren:
https://llm.aihosting.mittwald.de/v1 - Modell wählen:
Qwen3.5-122B-A10B-FP8
Best Practices
Modellwahl
- Qwen3.5-122B-A10B-FP8: Startpunkt für agentic Coding, Refactoring und Tool Use
- Qwen3.8-27B-NVFP4: schnellere Antworten als das 122B-Modell, bei etwas geringerer Qualität
- Qwen3.6-35B-A3B-FP8: Inline-Completion und schnelle Edits, wo Latenz mehr zählt als Tiefe
- gpt-oss-120b: komplexes Reasoning, präzise Dokumentation, anspruchsvolle Automatisierungen
- Ministral-3-14B-Instruct-2512: leichtgewichtige Assistenten und einfacher Chat
Tipps für Long Context
- Nicht das ganze Repo senden, nur relevante Dateien/Funktionskörper
- Vorherige Schritte zusammenfassen und IDs/Anker für Rehydration nutzen
- Antworten streamen,
max_tokensnur bei Bedarf erhöhen - Für Tools/Edits deterministisch bleiben:
temperature <= 0.2 - Repo-Scope bewusst klein halten
- Bei Orchestrierung mehrstufiger Änderungen bevorzugt strukturierte Outputs (JSON/Tool-Output) nutzen
MCP Server Integration
Viele IDEs unterstützen Model Context Protocol (MCP) Server für erweiterte Fähigkeiten:
- Context7: Aktuelle Library-Dokumentation
- Brave Search: Websuche mit Privacy-Fokus
- Directus: Headless-CMS-Management
- OpenSearch: Suche, Index-Inspektion, Mappings und Cluster-Diagnostik
- TYPO3: TYPO3-CMS-Content und Backend-Automatisierung per MCP
- mittwald: Infrastruktur-Management in natürlicher Sprache
Für eine breitere Ökosystem-Liste siehe die MCP-Server-Registry.
Details zur MCP-Konfiguration findest du in den jeweiligen IDE-Guides.
Nächste Schritte
Wähle deine IDE bzw. dein Tool:
- JetBrains AI - IntelliJ, PHPStorm, WebStorm, etc.
- Continue - VS Code und JetBrains IDEs
- Cline - VS Code, Cursor, Windsurf
- Zed - Zed Editor
- Kilo Code - VS Code Extension
- CLI Agents - Hermes Agent, Pi und opencode im Terminal
Disclaimer
Drittanbieter-Tools, MCP-Server und externe Links werden zur Vereinfachung bereitgestellt, ohne Gewährleistung oder Empfehlung. Nutze sie auf eigenes Risiko, prüfe Lizenzen und Datenschutzrichtlinien und vergib nur die nötigen Berechtigungen (Least Privilege).