FAQ
Was ist ChunkChef?
Eine Dokumentenverarbeitungs-API: Sie senden Dateien und Text-Prompts und erhalten den erkannten Text und die Modellantworten für jede Datei zurück. Archive entpacken, Formate konvertieren, OCR und Modellaufruf — alles in einem asynchronen Job auf Ihrem Provider-Schlüssel.
Wie unterscheidet sich ChunkChef von normalem OCR oder einem Konverter?
ChunkChef kombiniert Entpacken, Konvertierung, OCR und den Sprachmodellaufruf in einem einzigen asynchronen Job, der auf Ihrem Provider-Schlüssel läuft. Es ist kein Format-Konverter und kein reines OCR-Tool.
Was ist BYOK, und warum ist das ein gutes Angebot?
Bring Your Own Key — Sie verbinden Ihren eigenen Modell-Provider-Schlüssel. Tokens und OCR zahlen Sie direkt beim Provider zu dessen Tarif; ChunkChef schlägt nichts drauf.
Wofür zahle ich ChunkChef?
Für das Tooling: Orchestrierung, Zuverlässigkeit (Retries, Recovery), Format- und Archiv-Unterstützung sowie laufende Weiterentwicklung und Support. Tokens und OCR werden direkt beim Provider über Ihren Schlüssel bezahlt.
Kann ich es kostenlos testen?
Ja. Registrieren Sie sich, erstellen Sie einen Schlüssel und senden Sie Jobs im Rahmen des kostenlosen Tarifs — keine Kreditkarte nötig.
Kann ich ChunkChef ohne Konto ausprobieren?
Ja — im Playground können Sie eine Datei hochladen und einen vorgefertigten Prompt ausführen, ohne sich zu registrieren. Er ist enger begrenzt als ein echtes Konto: wenige Durchläufe pro Sitzung, ein gemeinsames Tagesbudget und ein Limit von 10 MB pro Datei. Erstellen Sie ein kostenloses Konto direkt auf der Ergebnisseite, um das vollständige Ergebnis zu sehen und ohne diese Beschränkungen weiterzumachen.
Was passiert mit meinen Dokumenten und BYOK-Schlüsseln?
Alle drei Geheimnisse (neural.apiKey, ocr.providerKey und webhookSecret) werden nie im Klartext gespeichert; die verschlüsselten Artefakte und Ihre Dateien werden zusammen mit dem Job gelöscht (~7 Tage) — Details in der Sicherheitsdokumentation.
Welche Formate werden unterstützt?
21 Formate: PDF, DOC/DOCX, XLS/XLSX, PPT/PPTX, RTF, TXT, ODT, Bilder (JPG, PNG, TIFF, HEIC) und Archive ZIP/7Z/RAR/EML/MSG — siehe „Unterstützte Formate“.
Gibt es Limits?
Ja — für Job-Größe, Konverter-Antwortgröße, Timeouts und Prompt-Größe. Siehe „Limits“.
Bekomme ich garantiert valides JSON?
Standardmäßig bestimmen Ihr Prompt und das gewählte Modell die Ausgabestruktur — es gibt keine serverseitige Validierung. Übergeben Sie `responseSchema`, um sie zu aktivieren: ChunkChef validiert die Antwort dann und meldet `schemaValid`/`schemaErrors` (nur für Dateien mit einem einzigen Chunk).
Welches Modell soll ich wählen?
Kommt auf Aufgabe und Budget an. Vergleichen Sie Intelligenz und Preis pro Token der Modelle im LLM-Vergleich und tragen Sie es in die Job-Konfiguration ein.
Kann ich OCR statt hybrider Extraktion erzwingen?
Ja — setzen Sie `extractionMode` bei einem BYOK-Job auf `EXTRACTION_MODE_OCR_ALWAYS`, oder legen Sie einen Konto-Standard im Dashboard → Einstellungen fest. Der Standard, `EXTRACTION_MODE_HYBRID` („Optimierte Hybrid-Extraktion"), lässt den Konverter pro Datei entscheiden.
Kann ich vom Modell validiertes JSON bekommen?
Ja — übergeben Sie `responseSchema` (ein in sich geschlossenes JSON Schema) bei der Job-Erstellung. ChunkChef validiert die Antwort dagegen und meldet `schemaValid`/`schemaErrors` je Datei (nur für Dateien mit einem einzigen Chunk); eine nicht konforme Antwort setzt den Job auf `JOB_STATUS_PARTIAL`, statt ihn abzulehnen.
Woher weiß ich, ob ich den extrahierten Werten vertrauen kann?
Setzen Sie `consensus.mode` (setzt `responseSchema` voraus), damit ChunkChef die Extraktion 2-, 3- oder 5-mal ausführt und über jedes Feld abstimmt. Sie erhalten einen Übereinstimmungswert (`minAgreement`) und eine Liste dessen, worüber das Modell geschwankt hat — eine eingebaute Halluzinationsprüfung, zum k-fachen Token-Preis auf Ihrem eigenen Schlüssel.