Zum Hauptinhalt springen
Connic
Platform

Retrieval

Synchronisierte Quellen und hochgeladene Dokumente bilden einen semantischen Suchindex. Agenten greifen per Retrieval-Augmented Generation (RAG) auf die Inhalte zu.

Zuletzt aktualisiert

Überblick

Retrieval macht die Inhalte hochgeladener Dokumente für Agenten durchsuchbar. Wenn ein Agent das Tool retrieval_query verwendet, führt es eine semantische Suche über die hochgeladenen Inhalte aus und gibt die relevantesten Passagen zurück. Dieses Verfahren wird als Retrieval-Augmented Generation (RAG) bezeichnet.

Retrieval ist über den Tab Retrieval im Projekt erreichbar. Es gilt jeweils für das aktive Environment, sodass Produktivumgebung und Staging unterschiedliche Inhalte haben können.

Text- und Datei-Uploads werden als Ingestion Jobs in die Warteschlange gestellt und sind nach Abschluss der Indexierung durchsuchbar.

Inhalte hinzufügen

Klicke auf Add content, um Inhalte hochzuladen. Dafür gibt es zwei Möglichkeiten:

Text
Füge Text direkt ein. Das eignet sich für FAQs, Auszüge aus der Dokumentation, Produktbeschreibungen und andere strukturierte Texte.
Datei-Upload
Lade PDF-Dokumente, Bilder oder Textdateien hoch. Die Verarbeitung erfolgt im Hintergrund: Connic liest die Inhalte aus, teilt sie in Abschnitte auf und erstellt den Suchindex.
InhaltstypUnterstützte FormateVerarbeitung
Text
.txt, .md, .markdown, .csv, .json, .jsonl, .yaml, .yml, .logWird sofort angenommen und im Hintergrund in Abschnitte aufgeteilt. Für die semantische Suche werden daraus Embeddings erstellt.
PDF
.pdfDie Inhalte werden im Hintergrund ausgelesen und in Abschnitte aufgeteilt, aus denen Embeddings entstehen. Seitenzahlen bleiben in den Ergebnissen erhalten.
Image
.png, .jpg, .jpeg, .gif, .webpDie Bildinhalte werden im Hintergrund per Bilderkennung ausgelesen und als Embeddings für die Suche aufbereitet.

Öffne nach dem Upload im Retrieval-Bereich das Panel Ingestion, um aktuelle Jobs zu verfolgen, Fehler zu untersuchen und fehlgeschlagene Uploads erneut zu starten.

Upload-Optionen

FeldBeschreibung
Entry IDOptionale eigene Kennung. Ohne Angabe wird eine generiert. Hilfreich, um vorhandene Einträge zu aktualisieren.
NamespaceOptionaler, durch Punkte getrennter Pfad zur hierarchischen Organisation von Einträgen (z. B. policies.hr.leave). Agenten können innerhalb eines Namespaces und aller untergeordneten Namespaces suchen. Die maximale Tiefe beträgt 10 Ebenen.

Namespaces

Namespaces organisieren Retrieval-Einträge über durch Punkte getrennte Pfade in einer Hierarchie. Zum Beispiel policies.hr.leave, policies.legal und products.pricing.

  • Durchsuche Namespaces in der Baumansicht in der Seitenleiste des Retrieval-Bereichs. Klicke auf einen Namespace, um Einträge zu filtern; untergeordnete Namespaces werden einbezogen
  • Agenten können innerhalb eines Namespaces und aller untergeordneten Namespaces suchen. Eine Abfrage von policies durchsucht beispielsweise auch policies.hr.leave
  • Agenten können die Namespace-Hierarchie zur Laufzeit mit dem Tool retrieval_list_namespaces ermitteln
  • Die maximale Namespace-Tiefe beträgt 10 Ebenen

Retrieval abfragen

Retrieval lässt sich auf zwei Arten abfragen:

Über das Dashboard

Klicke im Retrieval-Bereich auf Search, um den Abfragedialog zu öffnen. Gib eine natürlichsprachliche Anfrage ein und filtere optional nach Namespace. Die Ergebnisse zeigen passende Passagen nach Relevanz-Score sortiert und verlinken auf den Quelleneintrag. So lässt sich prüfen, ob Retrieval für repräsentative Abfragen die erwarteten Inhalte zurückgibt.

Der Retrieval-Bereich im Dashboard: eine Namespace-Baumansicht in der Seitenleiste mit den Branches policies, runbooks und sales neben einer gefüllten Tabelle mit vier Text-Einträgen – demo-narrative, deploy-gate, connector-setup und approval-policy – jeweils mit der Anzahl ihrer Chunks.
Der Retrieval-Bereich: Durchsuche links den Namespace-Baum und rechts die indexierten Einträge oder klicke auf Search, um sie abzufragen.

Über Agenten

Gib Agenten mit retrieval_query, einem integrierten Predefined Tool, Zugriff auf Retrieval. Der Agent sucht nach relevanten Inhalten, wenn er zum Beantworten einer Frage zusätzlichen Kontext benötigt.

agents/support-agent.yaml
version: "1.0"

name: support-agent
type: llm
model: connic/gpt-5.6-terra
description: "Beantwortet Kundenfragen mithilfe von Retrieval"
system_prompt: |
  Du bist ein Agent für den Kundensupport.
  Verwende das Tool retrieval_query, um relevante Informationen
  zu finden, bevor du Fragen beantwortest.
tools:
  - retrieval_query

Vollständige Konfigurationsoptionen einschließlich Namespace-Filterung, Ergebnislimits und Score-Schwellenwerte stehen in den Dokumentation der Retrieval-Tools.

Synchronisierte Quellen

Verbinde unter Retrieval → Sources Notion, Confluence Cloud, Superhuman Docs (Coda) oder eine Website. Jede Quelle gilt für das aktive Environment und schreibt Einträge in den ausgewählten Namespace.

  • Notion, Confluence und Superhuman Docs unterstützen Zeitpläne im Abstand von 15 Minuten, stündlich, alle 6 Stunden, täglich oder wöchentlich
  • Website-Quellen unterstützen Zeitpläne alle 12 Stunden, täglich oder wöchentlich
  • Lege fest, ob Inhalte, die in der verbundenen Quelle fehlen, aus Retrieval entfernt oder beibehalten werden
  • Verwende Sync now für einen Run bei Bedarf und prüfe Anzahl und Fehler der Source Runs in den Quelldetails
  • Jedes während eines Source Runs aufgenommene Element wird mit dem Projektguthaben verrechnet

Einträge verwalten

Die Retrieval-Tabelle zeigt indexierte Einträge. Aktuelle Uploads und Ingestion-Fehler werden separat im Panel Ingestion erfasst.

  • Details anzeigen: Klicke auf einen Eintrag, um seinen vollständigen Inhalt, alle Chunks mit Token-Anzahl und die Metadaten zu sehen. Bei PDFs enthält jeder Chunk die Seitenzahl.
  • Filtern: Grenze die Liste durch Auswahl eines Namespaces in der Seitenleiste, Suche nach Eintrags-IDs oder Filterung nach Inhaltstyp ein
  • Löschen: Entferne einen Eintrag und alle seine Chunks aus dem Suchindex.
  • Upload-Status: Überwache im Ingestion-Panel Jobs mit den Statuswerten queued, processing, retrying, completed und failed.
Die Detailansicht des Eintrags demo-narrative: ein Metadatenblock mit source und environment als JSON über einem Bereich Content Chunks, in dem Chunk 1 mit 16 Tokens und seinem vollständigen Textinhalt angezeigt wird.
Beim Öffnen eines Eintrags werden seine Metadaten und jeder Abschnitt mit Token-Anzahl angezeigt.

Retrieval über Agenten verwalten

Neben dem Dashboard können Agenten Retrieval-Einträge mithilfe vordefinierter Tools programmatisch hinzufügen und entfernen:

ToolBeschreibung
retrieval_storeSpeichert Textinhalte in Retrieval. Unterstützt eigene Eintrags-IDs, Namespaces und Metadaten.
retrieval_deleteEntfernt einen bestimmten Eintrag anhand seiner ID oder löscht einen vollständigen Namespace. Optional kann anhand von Metadaten mit denselben MongoDB-artigen Operatoren wie bei db_find gefiltert werden.
retrieval_list_namespacesListet Namespaces und ihre Hierarchie auf, damit Agenten vor der Suche erkennen können, wie Inhalte organisiert sind.

Agenten können mit diesen Tools Zusammenfassungen verarbeiteter Dokumente speichern und Einträge löschen. Details zur Verwendung stehen in den Dokumentation der vordefinierten Tools, vollständige Konfigurationsoptionen in den Dokumentation der Retrieval-Tools.

Retrieval über die REST API verwalten

Retrieval API

Vollständige Request-/Response-Schemas und Parameter für alle Retrieval-Endpunkte.

Retrieval API öffnen

Die REST API unterstützt Retrieval-Uploads, Abfragen, Browsing, Löschen und Quellenverwaltung. Die hier gezeigten Endpunkte zum Hochladen, Abfragen, Durchsuchen und Löschen erfordern retrieval.manage. Quellenlisten und Ergebnisse von Source Runs erfordern retrieval.view; zum Verbinden, Bearbeiten, Synchronisieren und Entfernen von Quellen ist retrieval.manage erforderlich.

Alle Retrieval-Endpunkte benötigen den Query-Parameter environment_id, da Retrieval jeweils für ein Environment gilt.

Text hochladen

Füge Klartext zu Retrieval hinzu. Connic teilt den Text im Hintergrund in Abschnitte auf, erstellt Embeddings und indexiert die Inhalte. Die API gibt eine Job-ID zurück, mit der sich der Fortschritt verfolgen lässt. Optional können namespace, entry_id, chunk_size oder chunk_overlap festgelegt werden.

terminal
curl -X POST "https://api.connic.co/v1/projects/{project_id}/retrieval/text?environment_id={env_id}" \
  -H "Authorization: Bearer cnc_your_api_key" \
  -H "Content-Type: application/json" \
  -d '{
    "content": "Dokumenttext...",
    "namespace": "docs.api",
    "entry_id": "api-reference-v2"
  }'

Dateien hochladen

Lade PDF-, PNG-, JPG-, JPEG-, GIF-, WebP-, TXT-, MD-, Markdown-, CSV-, JSON-, JSONL-, YAML-, YML- und LOG-Dateien als Multipart-Formulardaten hoch. Dateien werden asynchron verarbeitet. Die API gibt eine Job-ID zurück. Verwende namespace und entry_id als Query-Parameter, um den Eintrag zu organisieren.

terminal
curl -X POST "https://api.connic.co/v1/projects/{project_id}/retrieval/file?environment_id={env_id}&namespace=reports.q1" \
  -H "Authorization: Bearer cnc_your_api_key" \
  -F "file=@quarterly-report.pdf"

Durchsuchen und untersuchen

Liste Namespaces auf, durchsuche Einträge mit Paginierung und Filterung oder rufe alle Chunks für einen bestimmten Eintrag ab.

terminal
# Nach Namespace gefilterte Einträge auflisten
curl "https://api.connic.co/v1/projects/{project_id}/retrieval/entries?environment_id={env_id}&namespace=docs&limit=50" \
  -H "Authorization: Bearer cnc_your_api_key"

# Alle Chunks eines bestimmten Eintrags abrufen
curl "https://api.connic.co/v1/projects/{project_id}/retrieval/entries/api-reference-v2?environment_id={env_id}" \
  -H "Authorization: Bearer cnc_your_api_key"

# Namespace-Hierarchie auflisten
curl "https://api.connic.co/v1/projects/{project_id}/retrieval/namespaces?environment_id={env_id}&depth=3" \
  -H "Authorization: Bearer cnc_your_api_key"

Löschen

Entferne einzelne Einträge oder lösche einen vollständigen Namespace mit allen Inhalten einschließlich untergeordneter Namespaces.

terminal
# Einen einzelnen Eintrag löschen
curl -X DELETE "https://api.connic.co/v1/projects/{project_id}/retrieval/entries/api-reference-v2?environment_id={env_id}" \
  -H "Authorization: Bearer cnc_your_api_key"

# Einen vollständigen Namespace mit allen untergeordneten Inhalten löschen
curl -X DELETE "https://api.connic.co/v1/projects/{project_id}/retrieval/namespaces/reports.q1?environment_id={env_id}" \
  -H "Authorization: Bearer cnc_your_api_key"
Retrieval-Nutzung
Der für Retrieval belegte Speicher wird als Speichernutzung erfasst und aus dem Projektguthaben bezahlt. Bei der Quellensynchronisierung wird zusätzlich jedes erfolgreich übernommene Element abgerechnet. Die kombinierte Nutzung steht unter Projekt-Settings → Billing.