OpenAI запускает Flex-обработку для более дешевых и медленных задач
В попытке более агрессивно конкурировать с конкурирующими компаниями в области ИИ, такими как Google, OpenAI запускает обработку Flex — опцию API, которая обеспечивает более низкие цены на использование модели ИИ в обмен на более медленное время отклика и «периодическую недоступность ресурсов».
По словам OpenAI, гибкая обработка, доступная в бета-версии для недавно выпущенных OpenAI моделей рассуждений o3 и o4-mini, нацелена на низкоприоритетные и «непроизводственные» задачи, такие как оценка моделей, обогащение данных и асинхронные рабочие нагрузки.
Он снижает стоимость API ровно вдвое. Для o3 обработка Flex составляет $5 за миллион входных токенов (~750 000 слов) и $20 за миллион выходных токенов по сравнению со стандартными $10 за миллион входных токенов и $40 за миллион выходных токенов. Для o4-mini Flex снижает цену до $0,55 за миллион входных токенов и $2,20 за миллион выходных токенов с $1,10 за миллион входных токенов и $4,40 за миллион выходных токенов.
Запуск обработки Flex происходит на фоне того, что цена на передовой ИИ продолжает расти, а конкуренты выпускают более дешевые и эффективные бюджетно-ориентированные модели. В четверг Google выпустила Gemini 2.5 Flash, модель рассуждений, которая соответствует или превосходит DeepSeek R1 с точки зрения производительности при более низкой стоимости входного токена.
В электронном письме клиентам, объявляющем о запуске ценообразования Flex, OpenAI также указала, что разработчикам на уровнях 1–3 ее иерархии уровней использования придется пройти недавно введенную процедуру проверки идентификатора для доступа к o3. Уровни определяются суммой денег, потраченных на услуги OpenAI. Резюме рассуждений O3 и других моделей, а также поддержка API потоковой передачи также защищены проверкой.
Ранее OpenAI заявляла, что проверка личности призвана не допустить нарушения злоумышленниками ее политики использования.