Новая языковая модель GPT-6.1 Sol заменила GPT-6 Sol всего за 7 дней — и это, похоже, самый быстрый разворот в гонке больших языковых моделей за последнее время. По данным Artificial Analysis, новинка отстаёт от топовой GPT-6 Astra всего на 1 балл в Intelligence Index, а за одну задачу просит меньше четверти её цены. При этом прайс остался на уровне прошлой версии: $2 за миллион входных токенов и $10 за миллион выходных, только скидка за чтение кэша выросла с 90% до 95%. Проще говоря: умнее — да, дороже — нет.
Что вообще случилось
Если совсем по-человечески: за неделю одна модель сменила другую. GPT-6.1 Sol заменила GPT-6 Sol через 7 дней после её выхода. И это не косметическая правка — по сумме тестов новинка прибавила 4 балла в Intelligence Index относительно GPT-6 Sol и 5 баллов относительно GPT-5.6 Sol, оказавшись в 1 балле от GPT-6 Astra.
Пара слов про термины, чтобы не утонуть. Языковая модель — это программа, которая читает твой текст и продолжает его так, будто это написал человек. Токены — кусочки текста, примерно по 3–4 знака; именно за них ты платишь. Кэш — уже прочитанный моделью контекст, который при повторе ей обходится дешевле. Агент — это когда модель не просто отвечает одним сообщением, а сама делает цепочку шагов: открывает файл, считает, пишет, проверяет.
Что ещё важно в этой замене: снижение цены. До этого GPT-6 Sol и сам вышел с 50% скидкой относительно GPT-5.6 Sol. То есть мы видим второе подряд удешевление, и для рабочих задач (тех самых агентных сценариев) итоговая суммарная цена GPT-6.1 Sol получается чуть ниже, чем у прошлой версии.
Что это даёт лично тебе
Разберём не в баллах, а в людях.
• Мама двоих детей, которая делает уроки с младшим. Ей нужно объяснить дроби так, чтобы ребёнок понял, а не заплакал. Модель, которая на 5 баллов лучше в Humanity’s Last Exam и на 6 баллов в GDP.pdf, то есть в работе с документами, даёт более внятные пошаговые объяснения с первого раза — меньше переписывания одного и того же вопроса по кругу.
• Владелец кофейни. Он каждый вечер вручную сводит таблицу закупок и прогноз по молоку. Здесь работает то, что в AA-Briefcase v1.1 прибавка в 4 балла, а в GDPval-AA v2.1 — 5 баллов: это как раз тесты на «офисную» работу со сводками и отчётами. Он отдаёт модели свою таблицу и получает черновик плана, который надо только просмотреть.
• Фрилансер-дизайнер. Ему важно быстро описать концепцию заказчику текстом. Ошибок-выдумок стало меньше: точность в AA-Omniscience Accuracy выросла на 8 баллов, а частота галлюцинаций (когда модель уверенно придумывает факт) упала с 60% до 54%. Значит, меньше риска отправить клиенту письмо с липовой цифрой.
• Студент на заочке. Пишет курсовую по документам, разбросанным по десяткам PDF. Скачок на 12 баллов в Terminal-Bench 4.0 и на 6 баллов в GDP.pdf — это про работу в командной строке и с файлами: модель увереннее разбирает структуру папок и вытаскивает нужные абзацы.
• Тот, кто зарабатывает на контенте. Стоимость одной задачи у GPT-6.1 Sol — $0.72 против $3.26 у GPT-6 Astra, то есть меньше четверти. Если ты гоняешь десятки черновиков в день, разница в счёте за месяц видна невооружённым глазом.
• Небольшая команда, которая пишет код для внутренних нужд. В Artificial Analysis Coding Agent Index новинка прибавила 3 балла к GPT-6 Sol на максимальной настройке усилий и сидит в 2 баллах от Astra. Настройка xhigh, кстати, обошла max на 3 балла и при этом дала результат на 1 балл выше GPT-6 Astra меньше чем за 15% цены за задачу.
Как попробовать прямо сейчас
Шаг 1. Зайди в ChatGPT и возьми одну свою настоящую задачу — не тестовую, а ту, что реально лежит на столе: свести расходы, разобрать договор, написать письмо. Сохрани ответ и время, за которое он появился. Это твоя точка отсчёта.
Шаг 2. Открой страницу релиза GPT-6.1 Sol на Artificial Analysis и посмотри, какие есть языковые модели рядом с ней по цене. Там же удобно сравнивать: одна и та же задача, разные модели, разная цена.
Шаг 3. Определись с настройкой усилий. Логика простая: для коротких бытовых дел (письмо, план, объяснение) хватает низкого или среднего уровня — по данным источника, именно они оптимальны по расходу токенов. Высокий уровень включай, когда задача сложная и длинная.
Шаг 4. Посчитай свою цену. Если ты работаешь через сервис с оплатой по токенам, помни: вход — $2 за миллион, выход — $10 за миллион, а повторное чтение того же контекста дешевле на 95%. Один и тот же большой документ выгоднее держать в одной длинной переписке, а не открывать заново.
Шаг 5. Проверь результат на факты. Даже с упавшей до 54% долей выдумок модель всё ещё может ошибаться — цифры, даты и цитаты сверяй руками.
Плюсы и что изменится
Главное: за ту же цену ты получаешь заметно больше интеллекта. Стоимость одной задачи на максимальных усилиях — $0.72, это на 31% меньше, чем у GPT-6 Sol ($1.05), и на 64% меньше, чем у GPT-5.6 Sol ($1.99). Авторы прямо пишут: все уровни усилий GPT-6.1 Sol выталкивают границу эффективности — при заданном уровне «ума» дешевле просто нет.
Для обычного человека это означает простую вещь: через месяц-полгода такие возможности доедут до привычных сервисов и подписок. То, что сегодня стоит копейки в пересчёте на задачу, станет нормой в интерфейсе, куда ты заходишь с телефона.
Где подвох и что не так
Честно: экономия не абсолютная. GPT-6.1 Sol тратит примерно на 10–30% больше выходных токенов, чем GPT-6 Sol, так что по «болтливости» она прожорливее — выкручивается повышением интеллекта, а не аккуратностью формулировок. Плюс в AA-Briefcase оценка за подачу (Presentation Elo) немного просела: смысл лучше, а внешняя упаковка чуть хуже. И да, выдумки остались — 54% это всё ещё половина случаев на том наборе вопросов, где модели положено не знать ответа.
Вывод и что сделать сегодня
Гонка ускорилась до недель. Модель, которая была топовой в понедельник, к следующему понедельнику уже «прошлый сезон» — и это не повод ждать, а повод забрать выгоду сейчас, пока конкуренты ждут «стабильной версии».
Одно действие на сегодня: возьми одну свою рутинную задачу и прогони её через ChatGPT, замерив время. Потом загляни на страницу сравнения моделей и прикинь, во сколько тебе обошлась бы та же работа на GPT-6.1 Sol. Свои результаты и вопросы скидывай в комментарии к посту в @aigoby — разберём, какая связка выгоднее именно под твою задачу.
🎁 Бонус: промпт для проверки модели на твоей задаче
Скопируй и подставь своё:
```
Ты — мой рабочий помощник. Вот моя задача: [ОПИШИ ЗАДАЧУ ОДНИМ АБЗАЦЕМ].
Вот материалы, с которыми надо работать: [ВСТАВЬ ТЕКСТ / СПИСОК ФАЙЛОВ / ТАБЛИЦУ].
Сделай по шагам:
1) Кратко перескажи, что от меня требуется, в 3 пунктах.
2) Задай мне не больше 3 уточняющих вопросов, без которых ответ будет неточным.
3) Дай готовый результат: [ФОРМАТ — письмо / план / таблица / чек-лист].
4) Отдельно перечисли всё, что ты предположил, но не знаешь наверняка, — я проверю.
5) Предложи, как сделать это же в следующий раз быстрее.
```
Плюс чек-лист из 3 пунктов, чтобы не переплачивать: держи один документ в одной длинной переписке (кэш дешевле на 95%), для простых дел ставь низкий или средний уровень усилий, а большие задачи режь на шаги — так ты платишь за нужное, а не за «подумать обо всём сразу».



Комментарии 0