OpenAI запускает новый скоростной тариф API под названием Ultrafast. Режим разгоняет модель GPT-5.6 Sol до 14 раз быстрее обычного — до 750 токенов в секунду на выдаче.
Секрет в железе: партнёрство с Cerebras, чьи чипы оптимизированы под инференс. Для разработчиков это другая экономика агентов — длинные цепочки рассуждений, которые раньше висели минутами, теперь пролетают за секунды.
Сэм Альтман анонсировал режим в X одним словом: «/ultrafast». А Грег Брокман добавил шире — движемся к тому, что вручную выбирать модель больше не придётся вовсе.