FAQ

Что такое ChunkChef?

API для обработки документов: вы отправляете файлы и текстовые промпты, получаете распознанный текст и ответы модели по каждому файлу. Распаковка архивов, конвертация, OCR и вызов модели — на нашей стороне.

Чем ChunkChef отличается от обычного OCR или конвертера?

ChunkChef объединяет распаковку, конвертацию, OCR и вызов языковой модели в одну асинхронную задачу, работающую на вашем ключе провайдера. Это не конвертер форматов и не «голый» OCR.

Что такое BYOK и почему это выгодно?

Bring Your Own Key — вы подключаете собственный ключ провайдера модели. Токены и OCR вы оплачиваете провайдеру напрямую по его тарифу; ChunkChef не делает наценку.

За что я плачу ChunkChef?

За инструмент: оркестрацию, надёжность (повторные попытки, восстановление), поддержку форматов и архивов, развитие и поддержку. Токены и OCR оплачиваются провайдеру через ваш ключ.

Можно ли попробовать бесплатно?

Да. Зарегистрируйтесь, создайте ключ и отправляйте задачи в рамках free-тарифа — без привязки карты.

Можно ли попробовать ChunkChef без регистрации?

Да — playground позволяет загрузить файл и запустить готовый промпт без регистрации. Он ограничен строже, чем реальный аккаунт: несколько запусков на сессию, общий дневной бюджет и лимит файла 10 МБ. Создайте бесплатный аккаунт со страницы результата, чтобы увидеть полный результат и продолжить без этих ограничений.

Что с моими документами и ключами BYOK?

Все три секрета (neural.apiKey, ocr.providerKey и webhookSecret) в открытом виде не хранятся; зашифрованные артефакты и файлы удаляются вместе с задачей (~7 дней) — подробнее в разделе «Безопасность и данные».

Какие форматы поддерживаются?

21 формат: PDF, DOC/DOCX, XLS/XLSX, PPT/PPTX, RTF, TXT, ODT, изображения (JPG, PNG, TIFF, HEIC) и архивы ZIP/7Z/RAR/EML/MSG — см. «Поддерживаемые форматы».

Есть ли лимиты?

Да — на размер задачи, размер файла-ответа, таймауты и размер промпта. См. «Лимиты».

Получу ли я гарантированно валидный JSON?

По умолчанию структуру вывода определяет ваш промпт и выбранная модель — серверной валидации нет. Передайте `responseSchema`, чтобы включить проверку: ChunkChef будет валидировать ответ и сообщать `schemaValid`/`schemaErrors` (только для файлов из одной части).

Какую модель выбрать?

Зависит от задачи и бюджета. Сравните интеллект и цену за токен разных моделей в сравнении LLM и укажите её в конфигурации задачи.

Можно ли принудительно включить OCR вместо гибридного режима?

Да — укажите `extractionMode` со значением `EXTRACTION_MODE_OCR_ALWAYS` в BYOK-задаче или задайте дефолт аккаунта в личном кабинете → Настройки. По умолчанию действует `EXTRACTION_MODE_HYBRID` («Оптимизированное гибридное извлечение») — конвертер сам решает по каждому файлу.

Можно ли получить от модели провалидированный JSON?

Да — передайте `responseSchema` (самодостаточную JSON Schema) при создании задачи. ChunkChef проверит ответ по ней и сообщит `schemaValid`/`schemaErrors` по каждому файлу (только для файлов из одной части); несоответствующий ответ переводит задачу в статус `JOB_STATUS_PARTIAL`, а не отклоняет его.

Как понять, можно ли доверять извлечённым значениям?

Задайте `consensus.mode` (требует `responseSchema`), чтобы ChunkChef прогнал извлечение 2, 3 или 5 раз и проголосовал по каждому полю. Вы получите оценку согласия (`minAgreement`) и список того, в чём именно модель колебалась — встроенную проверку на галлюцинации ценой k-кратной стоимости токенов на вашем ключе.