connic/claude-haiku-4-5Schnelles KI-Modell für Coding und Agent-Aufgaben mit hohem Volumen.
low, medium, high- Kontextfenster
- 200k
- Input / 1 Mio.
- 1,10 €
- Gecachter Input / 1 Mio.
- 0,15 €
- Output / 1 Mio.
- 5,10 €
Konkrete KI-Modell-IDs, unterstützte Eingaben, Kontextlimits und Token-Preise in Euro für die verwaltete Inferenz von Connic.
Aktiviere bei vorausbezahlten Projekten unter Projekt → Billing die Option Auto-refill, bevor produktiver Traffic an connic/*-KI-Modelle gesendet wird. Wenn das verfügbare Guthaben aufgebraucht ist, werden weitere Aufrufe und Ausführungen im Projekt pausiert, bis Guthaben hinzugefügt wird.
Verwende eine konkrete ID aus dem Katalog als primäres KI-Modell oder Fallback. Ein Projekt kann von Connic verwaltete KI-Modelle und BYOK-KI-Modelle kombinieren.
model: connic/glm-5.2
fallback_model: connic/gpt-5.6-luna # or anthropic/claude-sonnet-4-6 with Anthropic BYOK configured
temperature: 0.3
reasoning_effort: highDie Preise verstehen sich netto in Euro pro eine Million Tokens. Ein Strich bedeutet, dass kein Rabatt für gecachte Eingaben verfügbar ist. Die aufgeführten Werte für Reasoning Effort sind die modellspezifischen YAML-Overrides. Lass reasoning_effort weg oder verwende auto, damit das KI-Modell sein Verhalten selbst steuert. Standard- und Fast-IDs stehen in derselben Zeile und haben dieselben Preise. Das Info-Symbol neben einer Fast-ID zeigt die unterstützten Reasoning-Einstellungen, das Kontextlimit und die Input-Modalitäten.
| Funktionen | ||||
|---|---|---|---|---|
Anbieter ohne Sitz in der EU Claude Haiku 4.5 connic/claude-haiku-4-5Schnelles KI-Modell für Coding und Agent-Aufgaben mit hohem Volumen. Anthropic · Provider terms Reasoning Effort low, medium, high | TextVisionReasoning | 200k | 1,10 € 0,15 € (gecacht) | 5,10 € |
Anbieter ohne Sitz in der EU Claude Opus 5 connic/claude-opus-5Fortschrittliches KI-Modell für lang laufende Agenten, komplexes Coding und professionelle Aufgaben. Anthropic · Provider terms Reasoning Effort low, medium, high | TextVisionReasoning | 1M | 5,20 € 0,55 € (gecacht) | 26,00 € |
Anbieter ohne Sitz in der EU Claude Sonnet 5 connic/claude-sonnet-5Leistungsstarkes KI-Modell für Coding, Agenten und alltägliche professionelle Aufgaben. Anthropic · Provider terms Reasoning Effort low, medium, high | TextVisionReasoning | 1M | 2,10 € 0,25 € (gecacht) | 10,40 € |
Anbieter mit Sitz in der EU Codestral 2508 connic/codestral-2508Coding-KI-Modell mit geringer Latenz für Codevervollständigung, Korrekturen und Testgenerierung. Mistral · Provider terms Reasoning Effort Nicht unterstützt | Text | 256k | 0,35 € 0,05 € (gecacht) | 0,95 € |
Anbieter mit Sitz in der EU DeepSeek V4 Flash 0731 connic/deepseek-v4-flash-0731connic/deepseek-v4-flash-0731-fastAktualisiertes Open-Weight-Reasoning-KI-Modell für Long-Context-Coding und agentische Aufgaben. DeepSeek · MIT Reasoning Effort none, low, high, max | TextReasoning | 256k | 0,45 € 0,10 € (gecacht) | 0,85 € |
Anbieter mit Sitz in der EU DeepSeek V4 Pro connic/deepseek-v4-pro-fastFortschrittliches Open-Weight-Reasoning-KI-Modell für komplexes Long-Context-Coding und agentische Aufgaben. DeepSeek · MIT Reasoning Effort high, max | TextReasoning | 1M | 1,70 € 0,45 € (gecacht) | 3,30 € |
Anbieter ohne Sitz in der EU Gemini 3.1 Flash Lite connic/gemini-3.1-flash-liteMultimodales KI-Modell mit geringer Latenz für kostensensitive Workloads mit hohem Volumen. Google · Provider terms Reasoning Effort low, medium, high | TextVisionReasoning | 1M | 0,30 € 0,05 € (gecacht) | 1,60 € |
Anbieter ohne Sitz in der EU Gemini 3.5 Flash connic/gemini-3.5-flashSchnelles fortschrittliches multimodales KI-Modell für Agenten, Coding und Aufgaben in großem Umfang. Google · Provider terms Reasoning Effort low, medium, high | TextVisionReasoning | 1M | 1,60 € 0,20 € (gecacht) | 9,40 € |
Anbieter ohne Sitz in der EU Gemini 3.5 Flash Lite connic/gemini-3.5-flash-liteMultimodales KI-Modell mit geringer Latenz für Subagent-Workflows mit hohem Volumen und Dokumentenverarbeitung. Google · Provider terms Reasoning Effort low, medium, high | TextVisionReasoning | 1M | 0,35 € 0,05 € (gecacht) | 2,60 € |
Anbieter ohne Sitz in der EU Gemini 3.6 Flash connic/gemini-3.6-flashSchnelles multimodales KI-Modell für agentisches Coding, Long-Context-Reasoning und mehrstufige Workflows. Google · Provider terms Reasoning Effort low, medium, high | TextVisionReasoning | 1M | 0,75 € 0,10 € (gecacht) | 3,60 € |
Anbieter ohne Sitz in der EU Gemini 3.7 Flash connic/gemini-3.7-flashSchnelles multimodales KI-Modell für agentisches Coding, Long-Context-Reasoning und mehrstufige Workflows. Google · Provider terms Reasoning Effort low, medium, high | TextVisionReasoning | 1M | 0,75 € 0,10 € (gecacht) | 3,60 € |
Anbieter mit Sitz in der EU Gemma 4 26B A4B connic/gemma-4-26b-a4b-itEffizientes agentisches Open-Weight-Reasoning-KI-Modell mit Bildverständnis. Google · Apache-2.0 Reasoning Effort none, low, medium, high | TextVisionReasoning | 256k | 0,30 € | 0,55 € |
Anbieter mit Sitz in der EU Gemma 4 31B IT connic/gemma-4-31b-itMultimodales Instruct-KI-Modell für Reasoning, Coding und die gemeinsame Verarbeitung von Bildern und Sprache. Google · Provider terms Reasoning Effort low, medium, high | TextVisionReasoning | 128k | 0,30 € | 0,55 € |
Anbieter mit Sitz in der EU GLM 5.2 connic/glm-5.2connic/glm-5.2-fastOpen-Weight-Reasoning-KI-Modell für lang laufende agentische Aufgaben. Z.ai · MIT Reasoning Effort none, high, max | TextReasoning | 256k | 1,90 € 0,40 € (gecacht) | 5,80 € |
Anbieter mit Sitz in der EU GPT OSS 120B connic/gpt-oss-120bconnic/gpt-oss-120b-fastGroßes Open-Weight-Mixture-of-Experts-KI-Modell für Reasoning, Agenten und Aufgaben in der Softwareentwicklung. OpenAI · Provider terms Reasoning Effort low, medium, high | TextReasoning | 128k | 0,25 € | 0,70 € |
Anbieter ohne Sitz in der EU30 Tage Aufbewahrung beim Provider GPT-5.4 connic/gpt-5.4Fortschrittliches multimodales KI-Modell für professionelle Workflows, Coding und Agenten. OpenAI · Provider terms Reasoning Effort low, medium, high | TextVisionReasoning | 1M | 2,80 € 0,25 € (gecacht) | 14,60 € |
Anbieter ohne Sitz in der EU30 Tage Aufbewahrung beim Provider GPT-5.6 Luna connic/gpt-5.6-lunaSchnelles multimodales KI-Modell für Aufgaben mit hohem Volumen und einfache Reasoning-Aufgaben. OpenAI · Provider terms Reasoning Effort low, medium, high | TextVisionReasoning | 1M | 0,25 € 0,05 € (gecacht) | 1,30 € |
Anbieter ohne Sitz in der EU30 Tage Aufbewahrung beim Provider GPT-5.6 Sol connic/gpt-5.6-solMultimodales Spitzenmodell für fortgeschrittenes Reasoning, Deep Research und komplexe mehrstufige Ausführung. OpenAI · Provider terms Reasoning Effort low, medium, high | TextVisionReasoning | 1M | 5,20 € 0,55 € (gecacht) | 31,20 € |
Anbieter ohne Sitz in der EU30 Tage Aufbewahrung beim Provider GPT-5.6 Terra connic/gpt-5.6-terraAusgewogenes multimodales KI-Modell für professionelle Aufgaben, Coding und Reasoning. OpenAI · Provider terms Reasoning Effort low, medium, high | TextVisionReasoning | 1M | 2,10 € 0,25 € (gecacht) | 12,50 € |
Anbieter mit Sitz in der EU Kimi K2.7 Code connic/kimi-k2.7-code-fastOpen-Weight-KI-Modell für Coding-Agenten, die lang laufende Aufgaben in der Softwareentwicklung übernehmen. Moonshot AI · Modified MIT Reasoning Effort Automatisch (nicht konfigurierbar) | TextVisionReasoning | 256k | 1,20 € 0,30 € (gecacht) | 4,20 € |
Anbieter mit Sitz in der EU Kimi K3 connic/kimi-k3-fastFortschrittliches multimodales Open-Weight-KI-Modell für lang laufende Coding-, Reasoning- und Agentenaufgaben. Moonshot AI · Kimi K3 License Reasoning Effort Automatisch (nicht konfigurierbar) | TextVisionReasoning | 1M | 2,90 € | 14,20 € |
Anbieter mit Sitz in der EU Llama 3.3 70B Instruct connic/llama-3.3-70b-instructconnic/llama-3.3-70b-instruct-fastBewährtes mehrsprachiges Open-Weight-Instruct-KI-Modell für Text-Workloads. Meta · Llama 3.3 Community Reasoning Effort Nicht unterstützt | Text | 100k | 0,95 € | 0,95 € |
Anbieter mit Sitz in der EU MiniMax M2.7 connic/minimax-m2.7Autonomes KI-Modell zur Koordination mehrerer Agenten und für Aufgaben im Enterprise-Maßstab. MiniMax · Provider terms Reasoning Effort low, medium, high | TextReasoning | 197k | 0,65 € | 2,60 € |
Anbieter mit Sitz in der EU Ministral 3 14B connic/ministral-14b-2512Kompaktes fortschrittliches multimodales KI-Modell für Text, Vision, Agenten und lokales Deployment. Mistral · Provider terms Reasoning Effort Nicht unterstützt | TextVision | 256k | 0,25 € 0,05 € (gecacht) | 0,25 € |
Anbieter mit Sitz in der EU Mistral Large 2512 connic/mistral-large-2512Multimodales Open-Weight-Mixture-of-Experts-KI-Modell zur Verarbeitung von Texten und Bildern. Mistral · Provider terms Reasoning Effort Nicht unterstützt | TextVision | 256k | 0,55 € 0,10 € (gecacht) | 1,60 € |
Anbieter mit Sitz in der EU Mistral Medium 3.5 128B connic/mistral-medium-3.5-128bOpen-Weight-KI-Modell, das die Befolgung von Anweisungen, Reasoning und Bildverständnis verbindet. Mistral · Modified MIT Reasoning Effort none, high | TextVisionReasoning | 180k | 1,60 € 0,15 € (gecacht) | 7,90 € |
Anbieter mit Sitz in der EU Mistral Small 3.2 24B connic/mistral-small-3.2-24b-instruct-2506Effizientes Open-Weight-KI-Modell für Text und Bilder mit schnellen Antworten in Agent-Workloads. Mistral · Apache-2.0 Reasoning Effort Nicht unterstützt | TextVision | 128k | 0,15 € | 0,35 € |
Anbieter mit Sitz in der EU Mistral Small 4 2603 connic/mistral-small-2603connic/mistral-small-2603-fastEffizientes multimodales KI-Modell für automatisches Reasoning, Agenten und Coding. Mistral · Provider terms Reasoning Effort Automatisch (nicht konfigurierbar) | TextVisionReasoning | 256k | 0,25 € 0,05 € (gecacht) | 0,65 € |
Anbieter mit Sitz in der EU Qwen 3 235B A22B Instruct connic/qwen3-235b-a22b-instruct-2507Großes mehrsprachiges Open-Weight-Instruct-KI-Modell für anspruchsvolle Text-Workloads. Qwen · Apache-2.0 Reasoning Effort Nicht unterstützt | Text | 250k | 0,75 € | 2,30 € |
Anbieter mit Sitz in der EU Qwen 3.5 397B A17B connic/qwen3.5-397b-a17bconnic/qwen3.5-397b-a17b-fastFortschrittliches Open-Weight-Reasoning-KI-Modell mit Bildverständnis. Qwen · Apache-2.0 Reasoning Effort none, low, medium, high | TextVisionReasoning | 250k | 0,65 € | 3,80 € |
Anbieter mit Sitz in der EU Qwen 3.6 35B A3B connic/qwen3.6-35b-a3bconnic/qwen3.6-35b-a3b-fastSchnelles Open-Weight-KI-Modell für agentische Aufgaben, Reasoning und Bildverständnis. Qwen · Apache-2.0 Reasoning Effort none, low, medium, high | TextVisionReasoning | 256k | 0,30 € | 1,60 € |
Anbieter mit Sitz in der EU Voxtral Small 2507 connic/voxtral-small-2507Effizientes Mistral-KI-Modell für mehrsprachiges Textverständnis und Textgenerierung. Mistral · Provider terms Reasoning Effort Nicht unterstützt | Text | 32k | 0,15 € 0,05 € (gecacht) | 0,35 € |
connic/claude-haiku-4-5Schnelles KI-Modell für Coding und Agent-Aufgaben mit hohem Volumen.
low, medium, highconnic/claude-opus-5Fortschrittliches KI-Modell für lang laufende Agenten, komplexes Coding und professionelle Aufgaben.
low, medium, highconnic/claude-sonnet-5Leistungsstarkes KI-Modell für Coding, Agenten und alltägliche professionelle Aufgaben.
low, medium, highconnic/codestral-2508Coding-KI-Modell mit geringer Latenz für Codevervollständigung, Korrekturen und Testgenerierung.
Nicht unterstütztconnic/deepseek-v4-flash-0731connic/deepseek-v4-flash-0731-fastAktualisiertes Open-Weight-Reasoning-KI-Modell für Long-Context-Coding und agentische Aufgaben.
none, low, high, maxconnic/deepseek-v4-pro-fastFortschrittliches Open-Weight-Reasoning-KI-Modell für komplexes Long-Context-Coding und agentische Aufgaben.
high, maxconnic/gemini-3.1-flash-liteMultimodales KI-Modell mit geringer Latenz für kostensensitive Workloads mit hohem Volumen.
low, medium, highconnic/gemini-3.5-flashSchnelles fortschrittliches multimodales KI-Modell für Agenten, Coding und Aufgaben in großem Umfang.
low, medium, highconnic/gemini-3.5-flash-liteMultimodales KI-Modell mit geringer Latenz für Subagent-Workflows mit hohem Volumen und Dokumentenverarbeitung.
low, medium, highconnic/gemini-3.6-flashSchnelles multimodales KI-Modell für agentisches Coding, Long-Context-Reasoning und mehrstufige Workflows.
low, medium, highconnic/gemini-3.7-flashSchnelles multimodales KI-Modell für agentisches Coding, Long-Context-Reasoning und mehrstufige Workflows.
low, medium, highconnic/gemma-4-26b-a4b-itEffizientes agentisches Open-Weight-Reasoning-KI-Modell mit Bildverständnis.
none, low, medium, highconnic/gemma-4-31b-itMultimodales Instruct-KI-Modell für Reasoning, Coding und die gemeinsame Verarbeitung von Bildern und Sprache.
low, medium, highconnic/glm-5.2connic/glm-5.2-fastOpen-Weight-Reasoning-KI-Modell für lang laufende agentische Aufgaben.
none, high, maxconnic/gpt-oss-120bconnic/gpt-oss-120b-fastGroßes Open-Weight-Mixture-of-Experts-KI-Modell für Reasoning, Agenten und Aufgaben in der Softwareentwicklung.
low, medium, highconnic/gpt-5.4Fortschrittliches multimodales KI-Modell für professionelle Workflows, Coding und Agenten.
low, medium, highconnic/gpt-5.6-lunaSchnelles multimodales KI-Modell für Aufgaben mit hohem Volumen und einfache Reasoning-Aufgaben.
low, medium, highconnic/gpt-5.6-solMultimodales Spitzenmodell für fortgeschrittenes Reasoning, Deep Research und komplexe mehrstufige Ausführung.
low, medium, highconnic/gpt-5.6-terraAusgewogenes multimodales KI-Modell für professionelle Aufgaben, Coding und Reasoning.
low, medium, highconnic/kimi-k2.7-code-fastOpen-Weight-KI-Modell für Coding-Agenten, die lang laufende Aufgaben in der Softwareentwicklung übernehmen.
Automatisch (nicht konfigurierbar)connic/kimi-k3-fastFortschrittliches multimodales Open-Weight-KI-Modell für lang laufende Coding-, Reasoning- und Agentenaufgaben.
Automatisch (nicht konfigurierbar)connic/llama-3.3-70b-instructconnic/llama-3.3-70b-instruct-fastBewährtes mehrsprachiges Open-Weight-Instruct-KI-Modell für Text-Workloads.
Nicht unterstütztconnic/minimax-m2.7Autonomes KI-Modell zur Koordination mehrerer Agenten und für Aufgaben im Enterprise-Maßstab.
low, medium, highconnic/ministral-14b-2512Kompaktes fortschrittliches multimodales KI-Modell für Text, Vision, Agenten und lokales Deployment.
Nicht unterstütztconnic/mistral-large-2512Multimodales Open-Weight-Mixture-of-Experts-KI-Modell zur Verarbeitung von Texten und Bildern.
Nicht unterstütztconnic/mistral-medium-3.5-128bOpen-Weight-KI-Modell, das die Befolgung von Anweisungen, Reasoning und Bildverständnis verbindet.
none, highconnic/mistral-small-3.2-24b-instruct-2506Effizientes Open-Weight-KI-Modell für Text und Bilder mit schnellen Antworten in Agent-Workloads.
Nicht unterstütztconnic/mistral-small-2603connic/mistral-small-2603-fastEffizientes multimodales KI-Modell für automatisches Reasoning, Agenten und Coding.
Automatisch (nicht konfigurierbar)connic/qwen3-235b-a22b-instruct-2507Großes mehrsprachiges Open-Weight-Instruct-KI-Modell für anspruchsvolle Text-Workloads.
Nicht unterstütztconnic/qwen3.5-397b-a17bconnic/qwen3.5-397b-a17b-fastFortschrittliches Open-Weight-Reasoning-KI-Modell mit Bildverständnis.
none, low, medium, highconnic/qwen3.6-35b-a3bconnic/qwen3.6-35b-a3b-fastSchnelles Open-Weight-KI-Modell für agentische Aufgaben, Reasoning und Bildverständnis.
none, low, medium, highconnic/voxtral-small-2507Effizientes Mistral-KI-Modell für mehrsprachiges Textverständnis und Textgenerierung.
Nicht unterstütztProvider-Labels neben einem KI-Modell-Namen zeigen an, ob der Provider aus der EU stammt. EU-native provider kennzeichnet einen Provider mit Sitz in der EU, während Non-EU-native provider ein KI-Modell kennzeichnet, dessen Provider seinen Sitz außerhalb der EU hat. Das zusätzliche Label 30-day provider retention kennzeichnet einen Provider, der Anfragedaten gemäß seiner eigenen Richtlinie 30 Tage lang speichert. Unabhängig vom Sitz des Providers wird die Inferenz in der EU ausgeführt.
Eine ID mit der Endung -fast wählt eine für geringe Latenz optimierte KI-Modell-Variante. Bei den meisten KI-Modellen sind Standard- und Fast-IDs zum selben Preis aufgeführt; manche haben nur eine Fast-ID.
model: connic/glm-5.2-fast
reasoning_effort: high # -fast accepts a narrower set than connic/glm-5.2reasoning_effort-Werte, ein kleineres Kontextfenster oder weniger Input-Modalitäten. Ein Wert, den die Fast-ID nicht akzeptiert, wird abgelehnt.Bei fehlgeschlagenen KI-Modell-Anfragen greifen retry_options. Ohne Fallback nutzt das primäre KI-Modell das konfigurierte Budget an Versuchen. Mit einem konfigurierten fallback_model wird das primäre KI-Modell einmal versucht und das Fallback-KI-Modell nutzt dieses Budget. Ein Wechsel markiert den Run mit context.fallback_model_used.
Wiederholungsversuche gelten für die einzelne KI-Modell-Anfrage, nicht für den gesamten Run. Abgeschlossene Tool-Aufrufe behalten daher ihre Ergebnisse. Versuche und Backoff lassen sich unter Ausführungslimits und Wiederholungsversuche konfigurieren.
Eine Anfrage an ein von Connic verwaltetes KI-Modell, die vorzeitig endet, weil der Run sein timeout erreicht oder gestoppt wurde, wird mit null Tokens abgerechnet. Das dafür reservierte Guthaben wird dem Projektguthaben wieder gutgeschrieben. Das gilt gleichermaßen für Streaming- und Nicht-Streaming-Anfragen.
connic/*-Anfrage wird in der EU ausgeführt. Wenn keine Ausführung in der EU verfügbar ist, schlägt die Anfrage fehl.Die Zusage für connic/* gilt für den KI-Modell-Aufruf. Ein vollständiges Projekt bleibt EU-exklusiv, wenn auch jede vom Kunden konfigurierte Komponente – einschließlich BYOK-Provider, Tools, Guardrails, Judges und externer Datenziele – in der EU bleibt.
KI-Modelle und Provider
Konfiguration für von Connic verwaltete KI-Modelle und BYOK vergleichen
Runtime-Steuerung
Fallbacks, Wiederholungsversuche und Reasoning konfigurieren
Nutzung und Budgets
Token-Ausgaben verfolgen und Limits festlegen
Agent YAML
Die vollständige Referenz zur Agent-Konfiguration ansehen