С 19 августа 2026 года разработчики начали сообщать о сбоях OpenAI Batch API при работе с файлами. К концу августа проблема затронула /v1/responses, /v1/chat/completions, /v1/embeddings, генерацию изображений и видео.
Типичный сценарий выглядит так:
Cannot find file file-..., or organization org-... does not have access to it.
При этом файл успешно загружается в OpenAI:
purpose: batch
status: processed
Files API видит его и отдаёт содержимое. Затем Batch создаётся, переходит в validating и падает ещё до первого запроса:
completed: 0
failed: 0
total: 0
Если у вас совпадает эта последовательность, причина с высокой вероятностью находится на стороне Batch API. Пользователи воспроизводят её через официальный SDK, обычные HTTP-запросы и интерфейс OpenAI.
Почему проблема особенно неприятная
Batch API используют для больших фоновых задач: переводов, классификации, генерации описаний, обработки каталогов, embeddings, изображений и других операций, где ответ можно получить позже.
У Batch API две важные особенности:
- цена запросов примерно на 50% ниже обычного API;
- один batch вмещает до 50 000 запросов и файл до 200 MB.
OpenAI даёт batch до 24 часов на выполнение. Поэтому переход на обычные запросы может почти удвоить стоимость обработки того же объёма токенов. Если сервис ежедневно обрабатывает 30 000 товаров через Batch API, аварийный переход на обычный API превращается уже в вопрос бюджета, а не только скорости.
Что произошло с 19 августа
По сообщениям разработчиков на OpenAI Community, первая волна появилась 19–21 августа. Тогда Batch запускался, а отдельные запросы с file_id получали ошибку доступа к файлам. У одного из разработчиков система снова работала 22–27 августа. С 28 августа появилась более тяжёлая версия проблемы: Batch теряет доступ уже к самому входному JSONL-файлу. В результате вся задача падает на стадии validating, а OpenAI успевает обработать ровно 0 запросов.
28 августа сотрудник OpenAI подтвердил воспроизведение ошибки и передал её команде. 31 августа OpenAI начал применять точечное исправление для отдельных организаций. Разработчиков просили присылать свежий batch_id и время запуска в UTC. После этого сотрудник OpenAI применял fix к конкретной организации и просил повторить тест. 2 сентября сообщения о новых затронутых организациях продолжают появляться.
Возможное решение
Один из первых рабочих обходных путей — создать новый OpenAI Project и выпустить для него новый API key. На форуме есть пример, где такой способ сразу восстановил Batch API. У меня результат оказался временным. Я создал новый проект, выпустил новый API key и перенёс туда обработку. Система снова заработала и успела провести примерно 3000 запросов. После этого Batch снова завис.
На форуме уже есть похожий пример с полностью новым проектом и свежим sk-proj ключом, где ошибка появилась снова. Поэтому новый проект стоит рассматривать как временный обходной путь. Для production на него лучше заложить автоматический fallback.
Как проверить свой проект за пять минут
Создайте минимальный JSONL всего с одним запросом.
Загрузите его:
purpose=batch
Получите file_id. Затем запросите этот файл через Files API. Если файл возвращается со статусом:
processed
создайте Batch с этим же file_id. После ошибки посмотрите request_counts.
Комбинация:
status: failed
completed: 0
failed: 0
total: 0
плюс:
Cannot find file ...
or organization ... does not have access to it
совпадает с текущим сбоем. Такой тест полезнее production-batch на 20 000 строк: получается маленький batch_id, который удобно отправить поддержке.
Что отправить OpenAI
Сейчас самый практичный путь — передать OpenAI конкретный упавший batch.
Подготовьте:
Organization ID
Project ID
Batch ID
Input File ID
Endpoint
UTC submission time
Например:
Organization:
org_xxxxxxxxx
Project:
proj_xxxxxxxxx
Batch:
batch_xxxxxxxxx
Input file:
file_xxxxxxxxx
Endpoint:
/v1/responses
Submitted:
2026-09-02 18:42 UTC
Также укажите:
File status: processed
Files API: 200
Batch status: failed
Request count: 0
Этого набора достаточно, чтобы команда OpenAI нашла организацию и проверила проблему с Batch validator. 31 августа сотрудник OpenAI прямо подтвердил применение исправления к организациям после получения их batch_id. На 2 сентября именно такой способ остаётся основным практическим вариантом: разработчики публикуют свежий batch_id, после чего просят применить исправление к своей организации.
Что делать с production прямо сейчас
Я бы построил обработку так:
1. Отправлять маленький тестовый Batch перед большой очередью.
Один запрос показывает состояние проекта почти без затрат.
2. Сохранять каждый batch_id вместе с file_id и временем UTC.
При сбое эти данные сразу готовы для поддержки.
3. После failed с total: 0 останавливать новые Batch-задачи.
Так очередь из тысячи заданий превращается в один диагностический batch вместо тысячи одинаковых ошибок.
4. Критичные задачи переводить на обычный API.
Цена обработки вырастет примерно в два раза относительно Batch-тарифа, зато production продолжит работу. Batch API даёт скидку 50% относительно стандартных запросов.
5. Новый Project + новый API key использовать как дополнительный канал.
Такой канал способен временно вернуть обработку. Мой проект выдержал около 3000 запросов, затем проблема появилась снова.
6. Отправить свежий batch_id в существующую тему OpenAI Community или открытый support case.
OpenAI сейчас просит именно свежий batch из затронутого проекта плюс точное время запуска в UTC.
Почему замена SDK обычно ничего не даёт
Ошибка возникает между двумя сервисами OpenAI. Files API принимает JSONL и видит файл. Batch API получает тот же file_id и падает при проверке доступа. Разработчики воспроизвели этот сценарий через SDK, прямые REST-запросы и OpenAI UI. Старые файлы, которые раньше успешно запускали Batch, у части пользователей теперь дают ту же ошибку.
Поэтому обновление Python-пакета, Node SDK или собственного клиента здесь находится далеко внизу списка действий. Сначала достаточно сделать тест из одного запроса и посмотреть request_counts.
Состояние на 2 сентября 2026 года
Полного восстановления Batch API для всех затронутых организаций OpenAI пока публично не подтвердил. На форуме OpenAI сообщает о targeted mitigation — точечном исправлении отдельных организаций. Общего срока восстановления компания пока тоже публично не назвала.
При этом отдельная запись про этот Batch API incident в истории status.openai.com за период с 19 августа по 2 сентября отсутствует. Страница статуса показывает другие API-инциденты, включая проблемы Responses API 31 августа и 1 сентября. Для разработчика сейчас рабочая схема выглядит просто:
один тестовый batch → total: 0 → сохранить ID → отправить OpenAI → включить fallback.
А новый проект и API key подходят как временный дополнительный канал, пока OpenAI устраняет проблему на уровне Batch API.