Zum Hauptinhalt springen
Connic
Build

Connic KI-Modelle

Konkrete KI-Modell-IDs, unterstützte Eingaben, Kontextlimits und Token-Preise in Euro für die verwaltete Inferenz von Connic.

Zuletzt aktualisiert
Auto-refill vor dem Produktivbetrieb aktivieren

Aktiviere bei vorausbezahlten Projekten unter Projekt → Billing die Option Auto-refill, bevor produktiver Traffic an connic/*-KI-Modelle gesendet wird. Wenn das verfügbare Guthaben aufgebraucht ist, werden weitere Aufrufe und Ausführungen im Projekt pausiert, bis Guthaben hinzugefügt wird.

Konfiguration

Verwende eine konkrete ID aus dem Katalog als primäres KI-Modell oder Fallback. Ein Projekt kann von Connic verwaltete KI-Modelle und BYOK-KI-Modelle kombinieren.

agents/assistant.yaml
model: connic/glm-5.2
fallback_model: connic/gpt-5.6-luna # or anthropic/claude-sonnet-4-6 with Anthropic BYOK configured
temperature: 0.3
reasoning_effort: high

Verfügbare KI-Modelle

Die Preise verstehen sich netto in Euro pro eine Million Tokens. Ein Strich bedeutet, dass kein Rabatt für gecachte Eingaben verfügbar ist. Die aufgeführten Werte für Reasoning Effort sind die modellspezifischen YAML-Overrides. Lass reasoning_effort weg oder verwende auto, damit das KI-Modell sein Verhalten selbst steuert. Standard- und Fast-IDs stehen in derselben Zeile und haben dieselben Preise. Das Info-Symbol neben einer Fast-ID zeigt die unterstützten Reasoning-Einstellungen, das Kontextlimit und die Input-Modalitäten.

Anbieter ohne Sitz in der EU
Claude Haiku 4.5
connic/claude-haiku-4-5

Schnelles KI-Modell für Coding und Agent-Aufgaben mit hohem Volumen.

Reasoning Effort: low, medium, high
TextVisionReasoning
Kontextfenster
200k
Input / 1 Mio.
1,10 €
Gecachter Input / 1 Mio.
0,15 €
Output / 1 Mio.
5,10 €
Anbieter ohne Sitz in der EU
Claude Opus 5
connic/claude-opus-5

Fortschrittliches KI-Modell für lang laufende Agenten, komplexes Coding und professionelle Aufgaben.

Reasoning Effort: low, medium, high
TextVisionReasoning
Kontextfenster
1M
Input / 1 Mio.
5,20 €
Gecachter Input / 1 Mio.
0,55 €
Output / 1 Mio.
26,00 €
Anbieter ohne Sitz in der EU
Claude Sonnet 5
connic/claude-sonnet-5

Leistungsstarkes KI-Modell für Coding, Agenten und alltägliche professionelle Aufgaben.

Reasoning Effort: low, medium, high
TextVisionReasoning
Kontextfenster
1M
Input / 1 Mio.
2,10 €
Gecachter Input / 1 Mio.
0,25 €
Output / 1 Mio.
10,40 €
Anbieter mit Sitz in der EU
Codestral 2508
connic/codestral-2508

Coding-KI-Modell mit geringer Latenz für Codevervollständigung, Korrekturen und Testgenerierung.

Reasoning Effort: Nicht unterstützt
Text
Kontextfenster
256k
Input / 1 Mio.
0,35 €
Gecachter Input / 1 Mio.
0,05 €
Output / 1 Mio.
0,95 €
Anbieter mit Sitz in der EU
DeepSeek V4 Flash 0731
connic/deepseek-v4-flash-0731
connic/deepseek-v4-flash-0731-fast

Aktualisiertes Open-Weight-Reasoning-KI-Modell für Long-Context-Coding und agentische Aufgaben.

Reasoning Effort: none, low, high, max
TextReasoning
Kontextfenster
256k
Input / 1 Mio.
0,45 €
Gecachter Input / 1 Mio.
0,10 €
Output / 1 Mio.
0,85 €
Anbieter mit Sitz in der EU
DeepSeek V4 Pro
connic/deepseek-v4-pro-fast

Fortschrittliches Open-Weight-Reasoning-KI-Modell für komplexes Long-Context-Coding und agentische Aufgaben.

Reasoning Effort: high, max
TextReasoning
Kontextfenster
1M
Input / 1 Mio.
1,70 €
Gecachter Input / 1 Mio.
0,45 €
Output / 1 Mio.
3,30 €
Anbieter ohne Sitz in der EU
Gemini 3.1 Flash Lite
connic/gemini-3.1-flash-lite

Multimodales KI-Modell mit geringer Latenz für kostensensitive Workloads mit hohem Volumen.

Reasoning Effort: low, medium, high
TextVisionReasoning
Kontextfenster
1M
Input / 1 Mio.
0,30 €
Gecachter Input / 1 Mio.
0,05 €
Output / 1 Mio.
1,60 €
Anbieter ohne Sitz in der EU
Gemini 3.5 Flash
connic/gemini-3.5-flash

Schnelles fortschrittliches multimodales KI-Modell für Agenten, Coding und Aufgaben in großem Umfang.

Reasoning Effort: low, medium, high
TextVisionReasoning
Kontextfenster
1M
Input / 1 Mio.
1,60 €
Gecachter Input / 1 Mio.
0,20 €
Output / 1 Mio.
9,40 €
Anbieter ohne Sitz in der EU
Gemini 3.5 Flash Lite
connic/gemini-3.5-flash-lite

Multimodales KI-Modell mit geringer Latenz für Subagent-Workflows mit hohem Volumen und Dokumentenverarbeitung.

Reasoning Effort: low, medium, high
TextVisionReasoning
Kontextfenster
1M
Input / 1 Mio.
0,35 €
Gecachter Input / 1 Mio.
0,05 €
Output / 1 Mio.
2,60 €
Anbieter ohne Sitz in der EU
Gemini 3.6 Flash
connic/gemini-3.6-flash

Schnelles multimodales KI-Modell für agentisches Coding, Long-Context-Reasoning und mehrstufige Workflows.

Reasoning Effort: low, medium, high
TextVisionReasoning
Kontextfenster
1M
Input / 1 Mio.
0,75 €
Gecachter Input / 1 Mio.
0,10 €
Output / 1 Mio.
3,60 €
Anbieter ohne Sitz in der EU
Gemini 3.7 Flash
connic/gemini-3.7-flash

Schnelles multimodales KI-Modell für agentisches Coding, Long-Context-Reasoning und mehrstufige Workflows.

Reasoning Effort: low, medium, high
TextVisionReasoning
Kontextfenster
1M
Input / 1 Mio.
0,75 €
Gecachter Input / 1 Mio.
0,10 €
Output / 1 Mio.
3,60 €
Anbieter mit Sitz in der EU
Gemma 4 26B A4B
connic/gemma-4-26b-a4b-it

Effizientes agentisches Open-Weight-Reasoning-KI-Modell mit Bildverständnis.

Reasoning Effort: none, low, medium, high
TextVisionReasoning
Kontextfenster
256k
Input / 1 Mio.
0,30 €
Gecachter Input / 1 Mio.
Output / 1 Mio.
0,55 €
Anbieter mit Sitz in der EU
Gemma 4 31B IT
connic/gemma-4-31b-it

Multimodales Instruct-KI-Modell für Reasoning, Coding und die gemeinsame Verarbeitung von Bildern und Sprache.

Reasoning Effort: low, medium, high
TextVisionReasoning
Kontextfenster
128k
Input / 1 Mio.
0,30 €
Gecachter Input / 1 Mio.
Output / 1 Mio.
0,55 €
Anbieter mit Sitz in der EU
GLM 5.2
connic/glm-5.2
connic/glm-5.2-fast

Open-Weight-Reasoning-KI-Modell für lang laufende agentische Aufgaben.

Reasoning Effort: none, high, max
TextReasoning
Kontextfenster
256k
Input / 1 Mio.
1,90 €
Gecachter Input / 1 Mio.
0,40 €
Output / 1 Mio.
5,80 €
Anbieter mit Sitz in der EU
GPT OSS 120B
connic/gpt-oss-120b
connic/gpt-oss-120b-fast

Großes Open-Weight-Mixture-of-Experts-KI-Modell für Reasoning, Agenten und Aufgaben in der Softwareentwicklung.

Reasoning Effort: low, medium, high
TextReasoning
Kontextfenster
128k
Input / 1 Mio.
0,25 €
Gecachter Input / 1 Mio.
Output / 1 Mio.
0,70 €
Anbieter ohne Sitz in der EU30 Tage Aufbewahrung beim Provider
GPT-5.4
connic/gpt-5.4

Fortschrittliches multimodales KI-Modell für professionelle Workflows, Coding und Agenten.

Reasoning Effort: low, medium, high
TextVisionReasoning
Kontextfenster
1M
Input / 1 Mio.
2,80 €
Gecachter Input / 1 Mio.
0,25 €
Output / 1 Mio.
14,60 €
Anbieter ohne Sitz in der EU30 Tage Aufbewahrung beim Provider
GPT-5.6 Luna
connic/gpt-5.6-luna

Schnelles multimodales KI-Modell für Aufgaben mit hohem Volumen und einfache Reasoning-Aufgaben.

Reasoning Effort: low, medium, high
TextVisionReasoning
Kontextfenster
1M
Input / 1 Mio.
0,25 €
Gecachter Input / 1 Mio.
0,05 €
Output / 1 Mio.
1,30 €
Anbieter ohne Sitz in der EU30 Tage Aufbewahrung beim Provider
GPT-5.6 Sol
connic/gpt-5.6-sol

Multimodales Spitzenmodell für fortgeschrittenes Reasoning, Deep Research und komplexe mehrstufige Ausführung.

Reasoning Effort: low, medium, high
TextVisionReasoning
Kontextfenster
1M
Input / 1 Mio.
5,20 €
Gecachter Input / 1 Mio.
0,55 €
Output / 1 Mio.
31,20 €
Anbieter ohne Sitz in der EU30 Tage Aufbewahrung beim Provider
GPT-5.6 Terra
connic/gpt-5.6-terra

Ausgewogenes multimodales KI-Modell für professionelle Aufgaben, Coding und Reasoning.

Reasoning Effort: low, medium, high
TextVisionReasoning
Kontextfenster
1M
Input / 1 Mio.
2,10 €
Gecachter Input / 1 Mio.
0,25 €
Output / 1 Mio.
12,50 €
Anbieter mit Sitz in der EU
Kimi K2.7 Code
connic/kimi-k2.7-code-fast

Open-Weight-KI-Modell für Coding-Agenten, die lang laufende Aufgaben in der Softwareentwicklung übernehmen.

Reasoning Effort: Automatisch (nicht konfigurierbar)
TextVisionReasoning
Kontextfenster
256k
Input / 1 Mio.
1,20 €
Gecachter Input / 1 Mio.
0,30 €
Output / 1 Mio.
4,20 €
Anbieter mit Sitz in der EU
Kimi K3
connic/kimi-k3-fast

Fortschrittliches multimodales Open-Weight-KI-Modell für lang laufende Coding-, Reasoning- und Agentenaufgaben.

Reasoning Effort: Automatisch (nicht konfigurierbar)
TextVisionReasoning
Kontextfenster
1M
Input / 1 Mio.
2,90 €
Gecachter Input / 1 Mio.
Output / 1 Mio.
14,20 €
Anbieter mit Sitz in der EU
Llama 3.3 70B Instruct
connic/llama-3.3-70b-instruct
connic/llama-3.3-70b-instruct-fast

Bewährtes mehrsprachiges Open-Weight-Instruct-KI-Modell für Text-Workloads.

Reasoning Effort: Nicht unterstützt
Text
Kontextfenster
100k
Input / 1 Mio.
0,95 €
Gecachter Input / 1 Mio.
Output / 1 Mio.
0,95 €
Anbieter mit Sitz in der EU
MiniMax M2.7
connic/minimax-m2.7

Autonomes KI-Modell zur Koordination mehrerer Agenten und für Aufgaben im Enterprise-Maßstab.

Reasoning Effort: low, medium, high
TextReasoning
Kontextfenster
197k
Input / 1 Mio.
0,65 €
Gecachter Input / 1 Mio.
Output / 1 Mio.
2,60 €
Anbieter mit Sitz in der EU
Ministral 3 14B
connic/ministral-14b-2512

Kompaktes fortschrittliches multimodales KI-Modell für Text, Vision, Agenten und lokales Deployment.

Reasoning Effort: Nicht unterstützt
TextVision
Kontextfenster
256k
Input / 1 Mio.
0,25 €
Gecachter Input / 1 Mio.
0,05 €
Output / 1 Mio.
0,25 €
Anbieter mit Sitz in der EU
Mistral Large 2512
connic/mistral-large-2512

Multimodales Open-Weight-Mixture-of-Experts-KI-Modell zur Verarbeitung von Texten und Bildern.

Reasoning Effort: Nicht unterstützt
TextVision
Kontextfenster
256k
Input / 1 Mio.
0,55 €
Gecachter Input / 1 Mio.
0,10 €
Output / 1 Mio.
1,60 €
Anbieter mit Sitz in der EU
Mistral Medium 3.5 128B
connic/mistral-medium-3.5-128b

Open-Weight-KI-Modell, das die Befolgung von Anweisungen, Reasoning und Bildverständnis verbindet.

Reasoning Effort: none, high
TextVisionReasoning
Kontextfenster
180k
Input / 1 Mio.
1,60 €
Gecachter Input / 1 Mio.
0,15 €
Output / 1 Mio.
7,90 €
Anbieter mit Sitz in der EU
Mistral Small 3.2 24B
connic/mistral-small-3.2-24b-instruct-2506

Effizientes Open-Weight-KI-Modell für Text und Bilder mit schnellen Antworten in Agent-Workloads.

Reasoning Effort: Nicht unterstützt
TextVision
Kontextfenster
128k
Input / 1 Mio.
0,15 €
Gecachter Input / 1 Mio.
Output / 1 Mio.
0,35 €
Anbieter mit Sitz in der EU
Mistral Small 4 2603
connic/mistral-small-2603
connic/mistral-small-2603-fast

Effizientes multimodales KI-Modell für automatisches Reasoning, Agenten und Coding.

Reasoning Effort: Automatisch (nicht konfigurierbar)
TextVisionReasoning
Kontextfenster
256k
Input / 1 Mio.
0,25 €
Gecachter Input / 1 Mio.
0,05 €
Output / 1 Mio.
0,65 €
Anbieter mit Sitz in der EU
Qwen 3 235B A22B Instruct
connic/qwen3-235b-a22b-instruct-2507

Großes mehrsprachiges Open-Weight-Instruct-KI-Modell für anspruchsvolle Text-Workloads.

Reasoning Effort: Nicht unterstützt
Text
Kontextfenster
250k
Input / 1 Mio.
0,75 €
Gecachter Input / 1 Mio.
Output / 1 Mio.
2,30 €
Anbieter mit Sitz in der EU
Qwen 3.5 397B A17B
connic/qwen3.5-397b-a17b
connic/qwen3.5-397b-a17b-fast

Fortschrittliches Open-Weight-Reasoning-KI-Modell mit Bildverständnis.

Reasoning Effort: none, low, medium, high
TextVisionReasoning
Kontextfenster
250k
Input / 1 Mio.
0,65 €
Gecachter Input / 1 Mio.
Output / 1 Mio.
3,80 €
Anbieter mit Sitz in der EU
Qwen 3.6 35B A3B
connic/qwen3.6-35b-a3b
connic/qwen3.6-35b-a3b-fast

Schnelles Open-Weight-KI-Modell für agentische Aufgaben, Reasoning und Bildverständnis.

Reasoning Effort: none, low, medium, high
TextVisionReasoning
Kontextfenster
256k
Input / 1 Mio.
0,30 €
Gecachter Input / 1 Mio.
Output / 1 Mio.
1,60 €
Anbieter mit Sitz in der EU
Voxtral Small 2507
connic/voxtral-small-2507

Effizientes Mistral-KI-Modell für mehrsprachiges Textverständnis und Textgenerierung.

Reasoning Effort: Nicht unterstützt
Text
Kontextfenster
32k
Input / 1 Mio.
0,15 €
Gecachter Input / 1 Mio.
0,05 €
Output / 1 Mio.
0,35 €

Provider-Labels neben einem KI-Modell-Namen zeigen an, ob der Provider aus der EU stammt. EU-native provider kennzeichnet einen Provider mit Sitz in der EU, während Non-EU-native provider ein KI-Modell kennzeichnet, dessen Provider seinen Sitz außerhalb der EU hat. Das zusätzliche Label 30-day provider retention kennzeichnet einen Provider, der Anfragedaten gemäß seiner eigenen Richtlinie 30 Tage lang speichert. Unabhängig vom Sitz des Providers wird die Inferenz in der EU ausgeführt.

Fast-IDs

Eine ID mit der Endung -fast wählt eine für geringe Latenz optimierte KI-Modell-Variante. Bei den meisten KI-Modellen sind Standard- und Fast-IDs zum selben Preis aufgeführt; manche haben nur eine Fast-ID.

agents/classifier.yaml
model: connic/glm-5.2-fast
reasoning_effort: high   # -fast accepts a narrower set than connic/glm-5.2
  • Fast- und Standard-IDs können beim gleichen Prompt unterschiedliche Ausgaben erzeugen.
  • Eine Fast-ID kann in drei Punkten eingeschränkter sein als ihre Standard-ID: weniger reasoning_effort-Werte, ein kleineres Kontextfenster oder weniger Input-Modalitäten. Ein Wert, den die Fast-ID nicht akzeptiert, wird abgelehnt.
  • Das Info-Symbol neben einer Fast-ID zeigt ihre Unterschiede zur Standard-ID. Wenn keine Unterschiede aufgeführt sind, stimmen die unterstützten Einstellungen überein.

Fallbacks und Wiederholungsversuche

Bei fehlgeschlagenen KI-Modell-Anfragen greifen retry_options. Ohne Fallback nutzt das primäre KI-Modell das konfigurierte Budget an Versuchen. Mit einem konfigurierten fallback_model wird das primäre KI-Modell einmal versucht und das Fallback-KI-Modell nutzt dieses Budget. Ein Wechsel markiert den Run mit context.fallback_model_used.

Wiederholungsversuche gelten für die einzelne KI-Modell-Anfrage, nicht für den gesamten Run. Abgeschlossene Tool-Aufrufe behalten daher ihre Ergebnisse. Versuche und Backoff lassen sich unter Ausführungslimits und Wiederholungsversuche konfigurieren.

Abgebrochene Anfragen

Eine Anfrage an ein von Connic verwaltetes KI-Modell, die vorzeitig endet, weil der Run sein timeout erreicht oder gestoppt wurde, wird mit null Tokens abgerechnet. Das dafür reservierte Guthaben wird dem Projektguthaben wieder gutgeschrieben. Das gilt gleichermaßen für Streaming- und Nicht-Streaming-Anfragen.

Inference und Datenverarbeitung in der EU

  • Jede connic/*-Anfrage wird in der EU ausgeführt. Wenn keine Ausführung in der EU verfügbar ist, schlägt die Anfrage fehl.
  • Inhalte aus der verwalteten Inferenz werden nicht zum Trainieren von KI-Modellen verwendet. Für die Abrechnung erfasst Connic die verwendeten KI-Modelle und die Anzahl der Tokens statt Prompt- oder Antwortinhalten. Eng begrenzte Ausnahmen für Sicherheits- und Fehlerdaten sind in der Datenschutzerklärung beschrieben.

Datenverarbeitung im gesamten Projekt

Die Zusage für connic/* gilt für den KI-Modell-Aufruf. Ein vollständiges Projekt bleibt EU-exklusiv, wenn auch jede vom Kunden konfigurierte Komponente – einschließlich BYOK-Provider, Tools, Guardrails, Judges und externer Datenziele – in der EU bleibt.