FAQ
Что такое ChunkChef?
API для обработки документов: вы отправляете файлы и текстовые промпты, получаете распознанный текст и ответы модели по каждому файлу. Распаковка архивов, конвертация, OCR и вызов модели — на нашей стороне.
Чем ChunkChef отличается от обычного OCR или конвертера?
ChunkChef объединяет распаковку, конвертацию, OCR и вызов языковой модели в одну асинхронную задачу, работающую на вашем ключе провайдера. Это не конвертер форматов и не «голый» OCR.
Что такое BYOK и почему это выгодно?
Bring Your Own Key — вы подключаете собственный ключ провайдера модели. Токены и OCR вы оплачиваете провайдеру напрямую по его тарифу; ChunkChef не делает наценку.
За что я плачу ChunkChef?
За инструмент: оркестрацию, надёжность (повторные попытки, восстановление), поддержку форматов и архивов, развитие и поддержку. Токены и OCR оплачиваются провайдеру через ваш ключ.
Можно ли попробовать бесплатно?
Да. Зарегистрируйтесь, создайте ключ и отправляйте задачи в рамках free-тарифа — без привязки карты.
Можно ли попробовать ChunkChef без регистрации?
Да — playground позволяет загрузить файл и запустить готовый промпт без регистрации. Он ограничен строже, чем реальный аккаунт: несколько запусков на сессию, общий дневной бюджет и лимит файла 10 МБ. Создайте бесплатный аккаунт со страницы результата, чтобы увидеть полный результат и продолжить без этих ограничений.
Что с моими документами и ключами BYOK?
Все три секрета (neural.apiKey, ocr.providerKey и webhookSecret) в открытом виде не хранятся; зашифрованные артефакты и файлы удаляются вместе с задачей (~7 дней) — подробнее в разделе «Безопасность и данные».
Какие форматы поддерживаются?
21 формат: PDF, DOC/DOCX, XLS/XLSX, PPT/PPTX, RTF, TXT, ODT, изображения (JPG, PNG, TIFF, HEIC) и архивы ZIP/7Z/RAR/EML/MSG — см. «Поддерживаемые форматы».
Есть ли лимиты?
Да — на размер задачи, размер файла-ответа, таймауты и размер промпта. См. «Лимиты».
Получу ли я гарантированно валидный JSON?
По умолчанию структуру вывода определяет ваш промпт и выбранная модель — серверной валидации нет. Передайте `responseSchema`, чтобы включить проверку: ChunkChef будет валидировать ответ и сообщать `schemaValid`/`schemaErrors` (только для файлов из одной части).
Какую модель выбрать?
Зависит от задачи и бюджета. Сравните интеллект и цену за токен разных моделей в сравнении LLM и укажите её в конфигурации задачи.
Можно ли принудительно включить OCR вместо гибридного режима?
Да — укажите `extractionMode` со значением `EXTRACTION_MODE_OCR_ALWAYS` в BYOK-задаче или задайте дефолт аккаунта в личном кабинете → Настройки. По умолчанию действует `EXTRACTION_MODE_HYBRID` («Оптимизированное гибридное извлечение») — конвертер сам решает по каждому файлу.
Можно ли получить от модели провалидированный JSON?
Да — передайте `responseSchema` (самодостаточную JSON Schema) при создании задачи. ChunkChef проверит ответ по ней и сообщит `schemaValid`/`schemaErrors` по каждому файлу (только для файлов из одной части); несоответствующий ответ переводит задачу в статус `JOB_STATUS_PARTIAL`, а не отклоняет его.
Как понять, можно ли доверять извлечённым значениям?
Задайте `consensus.mode` (требует `responseSchema`), чтобы ChunkChef прогнал извлечение 2, 3 или 5 раз и проголосовал по каждому полю. Вы получите оценку согласия (`minAgreement`) и список того, в чём именно модель колебалась — встроенную проверку на галлюцинации ценой k-кратной стоимости токенов на вашем ключе.