GPT-6.1 Sol: agent workflow через Responses API
29 сентября 2026 года OpenAI выпустила GPT-6.1 Sol: дешевле флагмана, для coding и агентских задач — но с жёстким условием: инструменты только через Responses API. Кто просто поменял ID модели, получил молча сломанные tool calls. Разбираем архитектуру запросов под 6.1 Sol: маршруты, запрещённые параметры, уровни reasoning и честную миграцию.
Срез на дату публикации: тарифы и каталог меняются — пересчитайте по методике статьи на свежих данных.
Короткий ответ
В GPT-6.1 Sol вызов инструментов работает только через Responses API, в Chat Completions отключён вместе с уровнями none/minimal и temperature/top_p. Миграция — это смена маршрута, а не только ID модели.
Что изменилось относительно 6 Sol
По документации модели: Responses API — полный доступ включая инструменты; Chat Completions — только без инструментов. Нет уровней reasoning none и minimal (маппить на low), нет своих temperature/top_p/logprobs при effort от low и выше. Кэш чтения подешевел вдвое относительно 6 Sol. Контекст и лимиты вывода — как у 6 Sol, cutoff новее на 10 дней.
Для роутера это означает: 6.1 Sol — не «тот же Sol дешевле», а отдельная ветка совместимости. Задачи с инструментами — только Responses-маршрутом; проверка capabilities перед отправкой обязательна, а не опциональна.
| Параметр | GPT-6 Sol | GPT-6.1 Sol |
|---|---|---|
| Tool calling в Chat | Только при effort none | Нет, только Responses |
| Reasoning none/minimal | Есть | Нет, маппить на low |
| temperature/top_p | Есть при none | Нет |
| Кэш чтения | Базовый | Дешевле вдвое |
- инструменты — только Responses
- none/minimal → low
- temperature/top_p убрать
- кэш дешевле, контекст тот же
Архитектура запросов: 4 изменения миграции
Первое: смените ID и держите его в конфиге для отката одной строкой. Второе: перенесите tool calls на Responses — структура запроса другая (input вместо messages, свои типы и call_id), копипаст чат-запроса не заведётся. Третье: вычистите запрещённые поля до отправки — SDK и прокси любят подставлять temperature по умолчанию, и отказ придёт уже с сервера. Четвёртое: привяжите effort к задаче (low — рутина и латентность, medium — дефолт, выше — сложное), а не оставляйте наследованный none.
Проверяйте связку в порядке: endpoint отвечает, инструменты реально вызываются (а не имитируются текстом), call_id стыкуется с результатом, итог проверяется по факту, а не по гладкости фразы. Ошибка «инструменты не работают» в 9 случаях из 10 — не тот маршрут, а не плохой промпт.
curl https://api.normahub.cc/v1/responses \
-H "Authorization: Bearer $NORMAHUB_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"input": "List three webhook retry risks. One line each.",
"stream": false
}'- ID в конфиге — откат одной строкой
- tool calls — только Responses-структурой
- запрещённые поля вычищать до отправки
- effort под задачу, не наследовать none
Ограничения и экономика
Модель дешевле флагмана и примерно на уровне 6 Sol по входу/выходу — выигрыш в кэше чтения и в цене за решённую задачу, а не в прайсе как таковом. Считайте $/успешный исход на своих задачах: дешёвая модель с процентом доработок может проиграть дорогой с первого раза. Multi-agent в Responses пока beta с отдельным флагом — в прод без пилота не тащить.
В каталоге NormaHub модель присутствует — сверяйте ID, endpoints и ставки на день: `gpt-6.1-sol` подтверждался 2 октября 2026 года. Если модели нет в ответе списка — не гадайте, берите ближайшую проверенную из каталога. Evergreen-правило статьи: маршрут важнее модели; сегодняшняя 6.1 завтра станет «старой», а привычка проверять маршрут останется.
- считать $/успешный исход, а не $/токен
- multi-agent beta — только пилот
- ID и ставки — из каталога на день
- маршрут важнее модели
Источники и связанные страницы
Следующий шаг
Открыть эту статью в Markdown·Поделиться в Telegram
Следующий материалPrompt caching в GPT-6: breakpoints и диагностика