FAQ

Qu'est-ce que ChunkChef ?

Une API de traitement de documents : vous envoyez des fichiers et des prompts texte, et récupérez le texte reconnu et les réponses du modèle pour chaque fichier. La décompression des archives, la conversion, l'OCR et l'appel au modèle se font de notre côté.

En quoi ChunkChef diffère-t-il d'un OCR classique ou d'un convertisseur ?

ChunkChef combine la décompression, la conversion, l'OCR et l'appel au modèle de langage en un seul job asynchrone s'exécutant sur votre clé de fournisseur. Ce n'est pas un convertisseur de formats ni un OCR brut.

Qu'est-ce que BYOK et pourquoi est-ce avantageux ?

Bring Your Own Key — vous connectez votre propre clé de fournisseur de modèle. Vous payez le fournisseur directement pour les tokens et l'OCR à son tarif ; ChunkChef n'ajoute aucune marge.

Pourquoi payer ChunkChef ?

Pour les outils : l'orchestration, la fiabilité (retries, récupération), le support des formats et archives, le développement continu et le support. Les tokens et l'OCR sont payés au fournisseur via votre clé.

Puis-je essayer gratuitement ?

Oui. Inscrivez-vous, créez une clé et envoyez des jobs dans le cadre de l'offre gratuite — sans carte bancaire.

Puis-je essayer ChunkChef sans compte ?

Oui — le playground vous permet d'envoyer un fichier et de lancer un prompt prédéfini sans inscription. Il est plus limité qu'un compte réel : peu d'exécutions par session, un budget quotidien partagé et une limite de 10 Mo par fichier. Créez un compte gratuit depuis l'écran de résultat pour voir le résultat complet et continuer sans ces limitations.

Que deviennent mes documents et mes clés BYOK ?

Les trois secrets (neural.apiKey, ocr.providerKey et webhookSecret) ne sont jamais stockés en clair ; les artefacts chiffrés et vos fichiers sont supprimés avec le job (~7 jours) — voir « Sécurité et données » pour les détails.

Quels formats sont pris en charge ?

21 formats : PDF, DOC/DOCX, XLS/XLSX, PPT/PPTX, RTF, TXT, ODT, images (JPG, PNG, TIFF, HEIC) et archives ZIP/7Z/RAR/EML/MSG — voir « Formats pris en charge ».

Y a-t-il des limites ?

Oui — sur la taille du job, la taille de la réponse du convertisseur, les délais d'attente et la taille du prompt. Voir « Limites ».

Suis-je garanti d'obtenir un JSON valide ?

Par défaut, votre prompt et le modèle choisi déterminent la structure de sortie — il n'y a aucune validation côté serveur. Transmettez `responseSchema` pour l'activer : ChunkChef valide alors la réponse et rapporte `schemaValid`/`schemaErrors` (uniquement pour les fichiers à un seul chunk).

Quel modèle choisir ?

Cela dépend de la tâche et du budget. Comparez l'intelligence et le prix par token des modèles dans le comparatif LLM, puis renseignez-le dans la configuration du job.

Puis-je forcer l'OCR au lieu de l'extraction hybride ?

Oui — définissez `extractionMode` sur `EXTRACTION_MODE_OCR_ALWAYS` pour un job BYOK, ou définissez une valeur par défaut au niveau du compte dans le tableau de bord → Paramètres. La valeur par défaut, `EXTRACTION_MODE_HYBRID` (« Extraction hybride optimisée »), laisse le convertisseur choisir par fichier.

Puis-je obtenir du modèle un JSON validé ?

Oui — transmettez `responseSchema` (un JSON Schema autonome) à la création du job. ChunkChef valide la réponse par rapport à celui-ci et rapporte `schemaValid`/`schemaErrors` par fichier (uniquement pour les fichiers à un seul chunk) ; une réponse non conforme place le job en `JOB_STATUS_PARTIAL` au lieu de la rejeter.

Comment savoir si je peux faire confiance aux valeurs extraites ?

Définissez `consensus.mode` (nécessite `responseSchema`) pour que ChunkChef exécute l'extraction 2, 3 ou 5 fois et vote sur chaque champ. Vous obtenez un score d'accord (`minAgreement`) et la liste précise de ce sur quoi le modèle a hésité — une vérification anti-hallucination intégrée, au prix de k fois le coût en tokens sur votre propre clé.