OpenAI запустила режим Ultrafast для модели GPT-6.1 Sol — самый быстрый тариф в своём API. Модель генерирует до 300 токенов в секунду: до 8 раз быстрее обычного в Codex и до 6 раз в API. Платить за скорость придётся в 6 раз больше. Разбираем, что за модель GPT-6.1 Sol, сколько стоит Ultrafast и где он реально окупается.
Что такое GPT-6.1 Sol
GPT-6.1 Sol — обновлённая «средняя» модель OpenAI, представленная в конце сентября. По тестам самой OpenAI она почти догнала флагманскую GPT-6 Astra в программировании, работе с компьютером и офисных задачах, но стоит в 5 раз дешевле Astra. Важно: «в 5 раз дешевле» — это именно по сравнению с Astra, а не со всеми нейросетями на рынке, как пишут в некоторых пересказах.
- Цена в API: $2 за 1 млн входных токенов, $0,10 за кэш, $10 за 1 млн выходных. У GPT-6 Astra — $10 / $1 / $50.
- Контекст: до 1,05 млн токенов, ответ — до 128 тысяч, по данным обзора.
- Где доступна: в API как
gpt-6.1-sol, а также в ChatGPT Work и Codex на тарифах Plus, Pro, Business, Enterprise и Edu.
Что такое режим Ultrafast
Ultrafast — это не новая модель, а платный уровень скорости для той же GPT-6.1 Sol. Ответ тот же по качеству, но приходит в разы быстрее — до 300 токенов в секунду. Для сравнения: у OpenAI есть ещё режим Fast за двойную цену, а Ultrafast стоит как три Fast.

- Цена: ×6 к обычной — $12 за 1 млн входных токенов, $0,60 за кэш и $60 за 1 млн выходных.
- Длинные запросы дороже: если промт больше 272 тысяч токенов, весь запрос считается по тарифу длинного контекста — $24 вход и $90 выход.
- В API: включается параметром
service_tier: "ultrafast"в Responses API, работает и с хранением данных в США и ЕС. - В Codex и ChatGPT Work: только на новом тарифе Pro 500 за $500 в месяц, а также в части корпоративных и образовательных договоров. В Enterprise режим сначала должен включить администратор.
Кому Ultrafast нужен, а кому нет
Ultrafast окупается там, где ожидание стоит дороже токенов: чат-боты поддержки и продаж, которые должны отвечать мгновенно, голосовые ассистенты, ИИ-агенты, которые делают десятки шагов подряд, и программисты в Codex, которым важна скорость правок.
Для массовых задач он невыгоден. Пример: 1 млн выходных токенов на обычном тарифе стоит $10, на Ultrafast — $60. Если тебе не важно, придёт ответ за 2 секунды или за 10, ты просто переплачиваешь в 6 раз.
Что это значит для арбитражника
- Тексты, хуки, переводы креативов — Ultrafast не нужен. Здесь выгоднее обычная GPT-6.1 Sol или дешёвые модели вроде Claude Haiku 5.5. Как встроить нейросети в работу с креативами, разбирали в гайде креативы для арбитража.
- Чат-боты в Telegram или на лендинге, которые отвечают лидам в реальном времени, — здесь скорость влияет на конверсию, и Ultrafast стоит протестировать.
- Автоматизация через агентов — запуск и проверка кампаний, разбор статистики. Если агент делает много шагов, ускорение в 6 раз заметно сокращает время работы.
- Тариф Pro 500 за $500 в месяц имеет смысл только командам, которые целый день сидят в Codex. Соло-байеру проще платить по API за конкретные задачи.
Частые вопросы
Сколько стоит GPT-6.1 Sol Ultrafast?
В 6 раз дороже обычного тарифа: $12 за 1 млн входных токенов и $60 за 1 млн выходных. В Codex и ChatGPT Work он доступен на тарифе Pro 500 за $500 в месяц.
Насколько Ultrafast быстрее?
До 300 токенов в секунду — до 8 раз быстрее в Codex и до 6 раз в API, по данным OpenAI. Независимых замеров пока нет.
Чем GPT-6.1 Sol отличается от GPT-6 Astra?
Sol — более дешёвая модель: по тестам OpenAI она близка к Astra в программировании и офисных задачах, но стоит примерно в 5 раз меньше.
Как включить Ultrafast в API?
Указать service_tier: "ultrafast" в запросе к Responses API для модели GPT-6.1 Sol.
Источники: OpenAI, VentureBeat, AlphaSignal, Kingy AI.



