Все статьи
Практика3 минутыОбновлено 2 октября 2026 г.Проверено 2 октября 2026 г.

GPT-6.1 Sol: agent workflow через Responses API

29 сентября 2026 года OpenAI выпустила GPT-6.1 Sol: дешевле флагмана, для coding и агентских задач — но с жёстким условием: инструменты только через Responses API. Кто просто поменял ID модели, получил молча сломанные tool calls. Разбираем архитектуру запросов под 6.1 Sol: маршруты, запрещённые параметры, уровни reasoning и честную миграцию.

Срез на дату публикации: тарифы и каталог меняются — пересчитайте по методике статьи на свежих данных.

Короткий ответ

В GPT-6.1 Sol вызов инструментов работает только через Responses API, в Chat Completions отключён вместе с уровнями none/minimal и temperature/top_p. Миграция — это смена маршрута, а не только ID модели.

Что изменилось относительно 6 Sol

По документации модели: Responses API — полный доступ включая инструменты; Chat Completions — только без инструментов. Нет уровней reasoning none и minimal (маппить на low), нет своих temperature/top_p/logprobs при effort от low и выше. Кэш чтения подешевел вдвое относительно 6 Sol. Контекст и лимиты вывода — как у 6 Sol, cutoff новее на 10 дней.

Для роутера это означает: 6.1 Sol — не «тот же Sol дешевле», а отдельная ветка совместимости. Задачи с инструментами — только Responses-маршрутом; проверка capabilities перед отправкой обязательна, а не опциональна.

ПараметрGPT-6 SolGPT-6.1 Sol
Tool calling в ChatТолько при effort noneНет, только Responses
Reasoning none/minimalЕстьНет, маппить на low
temperature/top_pЕсть при noneНет
Кэш чтенияБазовыйДешевле вдвое
  • инструменты — только Responses
  • none/minimal → low
  • temperature/top_p убрать
  • кэш дешевле, контекст тот же

Архитектура запросов: 4 изменения миграции

Первое: смените ID и держите его в конфиге для отката одной строкой. Второе: перенесите tool calls на Responses — структура запроса другая (input вместо messages, свои типы и call_id), копипаст чат-запроса не заведётся. Третье: вычистите запрещённые поля до отправки — SDK и прокси любят подставлять temperature по умолчанию, и отказ придёт уже с сервера. Четвёртое: привяжите effort к задаче (low — рутина и латентность, medium — дефолт, выше — сложное), а не оставляйте наследованный none.

Проверяйте связку в порядке: endpoint отвечает, инструменты реально вызываются (а не имитируются текстом), call_id стыкуется с результатом, итог проверяется по факту, а не по гладкости фразы. Ошибка «инструменты не работают» в 9 случаях из 10 — не тот маршрут, а не плохой промпт.

curl https://api.normahub.cc/v1/responses \
  -H "Authorization: Bearer $NORMAHUB_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6.1-sol",
    "input": "List three webhook retry risks. One line each.",
    "stream": false
  }'
  • ID в конфиге — откат одной строкой
  • tool calls — только Responses-структурой
  • запрещённые поля вычищать до отправки
  • effort под задачу, не наследовать none

Ограничения и экономика

Модель дешевле флагмана и примерно на уровне 6 Sol по входу/выходу — выигрыш в кэше чтения и в цене за решённую задачу, а не в прайсе как таковом. Считайте $/успешный исход на своих задачах: дешёвая модель с процентом доработок может проиграть дорогой с первого раза. Multi-agent в Responses пока beta с отдельным флагом — в прод без пилота не тащить.

В каталоге NormaHub модель присутствует — сверяйте ID, endpoints и ставки на день: `gpt-6.1-sol` подтверждался 2 октября 2026 года. Если модели нет в ответе списка — не гадайте, берите ближайшую проверенную из каталога. Evergreen-правило статьи: маршрут важнее модели; сегодняшняя 6.1 завтра станет «старой», а привычка проверять маршрут останется.

  • считать $/успешный исход, а не $/токен
  • multi-agent beta — только пилот
  • ID и ставки — из каталога на день
  • маршрут важнее модели

Источники и связанные страницы

Следующий шаг

Открыть эту статью в Markdown·Поделиться в Telegram

Следующий материалPrompt caching в GPT-6: breakpoints и диагностика