Два прозрачных кристалла на тёмной поверхности — высокий с тёплым свечением внутри и пониже с холодным синим
© Владимир Баринов

OpenAI выпустила GPT-6 Sol и GPT-6 Luna вдвое дешевле — и это главное в новости

OpenAI выпустила две новые модели, и главное в них не ум, а цена: та же работа через API стоит вдвое меньше. Что это меняет для бизнеса и что я с этим делаю.

Вчера, 22 сентября, OpenAI выпустила две новые модели — GPT-6 Sol и GPT-6 Luna. Все пишут, что они умнее. А меня зацепило другое: они вдвое дешевле предыдущих. И вот это, мне кажется, для бизнеса новость посерьёзнее.

Что произошло

OpenAI объявила о выпуске на своём форуме для разработчиков. Две модели — это две разные роли. Sol — для сложной работы, в том числе для кода. Luna — для потоковой рутины: пересказать документ, вытащить данные, ответить на типовой вопрос. Обе доступны через API, то есть их можно встроить в свой сервис. В ChatGPT и Codex они приходят на платные тарифы, а на бесплатном тарифе и тарифе Go Luna можно попробовать в настольном приложении.

Теперь цены. Работу ИИ через API считают в токенах — это кусочки слов, примерно как слоги. Миллион токенов на входе у Sol стоит 2 доллара, на выходе — 10. У предыдущей версии, GPT-5.6 Sol, было 4 и 20 — причём это уже были промо-цены. Ровно в два раза. У Luna ещё интереснее: 10 центов за миллион на входе и 50 на выходе против 20 и 120. То есть ответы подешевели больше чем вдвое.

Почему это важнее, чем кажется

Смотрите, как это устроено в бизнесе. Пока ИИ дорогой, его ставят туда, где он окупается сразу: поддержка, продажи. Всё остальное — «потом, когда подешевеет». Вот оно и подешевело. Получается, задачи, которые раньше не проходили по деньгам, сегодня проходят. Выжимки, данные из писем и документов, ответы по шаблону — ровно то, для чего и сделана Luna.

Второй момент — ошибки. OpenAI говорит, что Sol ошибается примерно вдвое реже предшественника. Но это их собственный замер — по реальным диалогам, где пользователи отмечали ошибки. Я бы не спешил верить до своей проверки. Кстати, прямого сравнения с Gemini и Grok в день выхода компания не показала — сравнивала только с моделями Anthropic.

И фон. Модели вышли примерно через полтора часа после того, как Anthropic выпустила свою Opus 5.5. Гонка идёт уже не только за ум, но и за цену. Для тех, кто платит, это хорошая гонка.

Металлические весы на тёмном камне: на лёгкой чаше один светящийся кристалл, на тяжёлой — горка тусклых монет
© Владимир Баринов

Что я с этим делаю

Я каждый день работаю с ИИ-агентами: они пишут код, ведут задачи, разбирают почту. И к любой новой модели у меня простой вопрос: а где она ломается? Из пресс-релиза этого не узнать. Соблазн переключиться в первый же день у меня, конечно, есть — азарт. Но основную работу я сразу не переношу. Неделю гоняю модель на боковых задачах, смотрю, где спотыкается, и только потом решаю.

А вот цену проверять не надо, её видно в счёте. Мне кажется, у многих рутинные задачи до сих пор крутятся на самой дорогой модели — просто потому, что так настроили в начале. Половину такой работы можно отдать модели попроще, и разницы в качестве вы, скорее всего, не заметите.

Кому это пока не нужно? Если вы пользуетесь ChatGPT просто как чатом — для вас меняется немного: ответы, если верить OpenAI, станут точнее, и всё. Новость про деньги — для тех, кто встраивает ИИ в свою работу.

Давайте так: откройте счёт за ИИ за прошлый месяц и найдите три самые частые задачи. Если это пересказы, выжимки и ответы по шаблону — переведите их на лёгкую модель и через неделю сравните. А если хотите разобрать это на своём случае — напишите мне.

Если хотите обсудить свой проект — напишите мне.

На сайтеTelegram