Загружаем подборку…

Как выбрать модель

Дешёвый ввод не всегда означает низкую стоимость запроса: учитывайте цену вывода, reasoning-токены, кеширование и среднюю длину ответа. Для классификации и извлечения данных компактная модель часто выгоднее флагмана.

Вопросы и ответы

Считайте полный типовой запрос: вход, кеш, reasoning и выход, а не только рекламную цену input-токенов.

Подборка включает модели с опубликованной ценой входа до $1 за 1 млн токенов; вывод и длинные контексты могут стоить дороже.

Используйте кэширование, короткий системный промпт, маршрутизацию простых задач в Lite-модель и лимиты reasoning/output.