FAQ

¿Qué es ChunkChef?

Una API de procesamiento de documentos: envía archivos y prompts de texto, y recibe el texto reconocido y las respuestas del modelo para cada archivo. La descompresión de archivos, la conversión, el OCR y la llamada al modelo ocurren en nuestro lado.

¿En qué se diferencia ChunkChef de un OCR normal o de un convertidor?

ChunkChef combina la descompresión, conversión, OCR y la llamada al modelo de lenguaje en una única tarea asíncrona que se ejecuta con su clave de proveedor. No es un convertidor de formatos ni un OCR a secas.

¿Qué es BYOK y por qué es ventajoso?

Bring Your Own Key — conecta su propia clave del proveedor de modelo. Paga al proveedor directamente por tokens y OCR a su tarifa; ChunkChef no aplica markup.

¿Por qué pago a ChunkChef?

Por la herramienta: orquestación, fiabilidad (reintentos, recuperación), soporte de formatos y archivos comprimidos, y desarrollo y soporte continuos. Los tokens y el OCR se pagan al proveedor a través de su clave.

¿Puedo probarlo gratis?

Sí. Regístrese, cree una clave y envíe tareas dentro del plan gratuito — sin tarjeta de crédito.

¿Puedo probar ChunkChef sin una cuenta?

Sí — el playground le permite subir un archivo y ejecutar un prompt predefinido sin registrarse. Está más limitado que una cuenta real: pocas ejecuciones por sesión, un presupuesto diario compartido y un límite de 10 MB por archivo. Cree una cuenta gratuita desde la pantalla de resultado para ver el resultado completo y seguir sin esas limitaciones.

¿Qué pasa con mis documentos y claves BYOK?

Los tres secretos (neural.apiKey, ocr.providerKey y webhookSecret) nunca se almacenan en texto plano; los artefactos cifrados y sus archivos se eliminan junto con la tarea (~7 días) — consulte «Seguridad y datos» para más detalles.

¿Qué formatos se admiten?

21 formatos: PDF, DOC/DOCX, XLS/XLSX, PPT/PPTX, RTF, TXT, ODT, imágenes (JPG, PNG, TIFF, HEIC) y archivos ZIP/7Z/RAR/EML/MSG — consulte «Formatos admitidos».

¿Hay límites?

Sí — de tamaño de tarea, tamaño de respuesta del convertidor, tiempos de espera y tamaño del prompt. Consulte «Límites».

¿Se me garantiza un JSON válido?

De forma predeterminada, su prompt y el modelo elegido determinan la estructura de salida — no hay validación del lado del servidor. Pase `responseSchema` para activarla: ChunkChef validará entonces la respuesta e informará `schemaValid`/`schemaErrors` (solo para archivos de un único fragmento).

¿Qué modelo elijo?

Depende de la tarea y el presupuesto. Compare la inteligencia y el precio por token de los modelos en la comparativa de LLM y defínalo en la configuración de la tarea.

¿Puedo forzar el OCR en lugar de la extracción híbrida?

Sí — establezca `extractionMode` en `EXTRACTION_MODE_OCR_ALWAYS` en una tarea BYOK, o defina un valor predeterminado de cuenta en el panel → Configuración. El valor predeterminado, `EXTRACTION_MODE_HYBRID` («Extracción híbrida optimizada»), deja que el convertidor elija por archivo.

¿Puedo obtener del modelo un JSON validado?

Sí — pase `responseSchema` (un JSON Schema autocontenido) al crear la tarea. ChunkChef validará la respuesta contra él e informará `schemaValid`/`schemaErrors` por archivo (solo para archivos de un único fragmento); una respuesta no conforme pone la tarea en `JOB_STATUS_PARTIAL` en lugar de rechazarla.

¿Cómo sé si puedo confiar en los valores extraídos?

Defina `consensus.mode` (requiere `responseSchema`) para que ChunkChef ejecute la extracción 2, 3 o 5 veces y vote cada campo. Obtendrá una puntuación de acuerdo (`minAgreement`) y una lista de exactamente en qué dudó el modelo — una verificación de alucinaciones integrada, al coste de k veces los tokens en su propia clave.