altrouter.ai
ОСНОВНОЕ

Стриминг

Установите stream: true, чтобы получать ответ по мере генерации как server-sent events (SSE), совместимые с OpenAI.

Как это работает

Каждое событие — строка data: {...} с чанком в формате chat.completion.chunk. Поток завершается строкой data: [DONE]. Токены reasoning-моделей приходят в delta.reasoning_content.

PythonJavaScriptcURL
stream = client.chat.completions.create(
    model="gpt-5.4",
    messages=[{"role": "user", "content": "Write a haiku"}],
    stream=True,
)
for chunk in stream:
    delta = chunk.choices[0].delta
    if delta.content:
        print(delta.content, end="", flush=True)
i
Резервное переключение (failover) возможно только до первого байта. Как только первое событие ушло клиенту, ответ закреплён за текущим маршрутом, и последующая ошибка приходит внутри потока как событие error.

Использование и токены

Финальный чанк несёт объект usage с числом токенов. Списание с баланса происходит по фактическому расходу после завершения потока.

ДалееСтруктурированный вывод