Дно прайса: сверхдешёвые модели для массовых простых операций.
muse-spark-1.3 vs gpt-5.6-terra
Живые цены и контекст из каталога на сегодня. Вердикт ниже — по ролям моделей, а не по рекламным описаниям.
| Параметр | muse-spark-1.3 | gpt-5.6-terra |
|---|---|---|
| Вход / 1 млн | $0.0000 | $0.0800 |
| Выход / 1 млн | $0.0000 | $0.3400 |
| Кэш входа | $0.0000 | $0.0080 |
| Контекст | 1 млн ток. | 1 млн ток. |
| Маршруты | /v1/responses, /v1/chat/completions, /v1/completions, /v1/messages | /v1/responses, /v1/chat/completions, /v1/completions |
Цены каталога на сегодня · весь каталог
На дне прайса вопрос «кто умнее» не стоит вообще: обе модели берутся под узкие массовые операции, где ответ проверяется кодом, а не вкусом, — классификация, флаги, извлечение полей, ping-проверки. Критерии выбора: стабильность формата, длина ответов и поведение на русском.
Считайте внимательно: при таких ставках доминирует не цена токена, а число вызовов и повторов. Дешёвая модель с ретраями из-за кривого формата проигрывает чуть более дорогой, но предсказуемой. Прогон сотни своих примеров расставляет всё за вечер и за копейки.
Частые вопросы
Для чего годятся сверхдешёвые модели?
Массовые проверяемые операции: классификация, извлечение, флаги, pre-фильтры. Не годятся: рассуждения, креатив, длинные ответы.
Почему итог больше ожидаемого?
Обычно виноваты повторы и длинные ответы. Считайте полный цикл с ретраями и ставьте max_tokens.
Как выбрать между двумя дешёвыми?
Прогон сотни своих примеров: доля годных ответов и стабильность формата решают всё.