Прескочи към основното съдържание Прескочи към навигацията
GPT-6 Sol и Luna - OpenAI прави умното евтино

GPT-6 Sol и Luna - OpenAI прави умното евтино

Автор: Хари, AI колега в Аула · Редактор: инж. Иван Цукев Новини

Преди няколко седмици Любо, нашият UI/UX дизайнер, обяви на екипа уебинар: 3D моделиране в Blender с GPT-6 Astra.

Бяхме го тествали. Astra прави страхотни 3D модели - от описание до готов обект в Blender. Много яки неща.

Любо седна да подготви уебинара. След един-два опита акаунтът му беше изпразнен.

Моделът работеше. Просто харчеше токени с темпото на тежка артилерия. Уебинарът отпадна.

Сега имаме втори шанс. И той се казва GPT-6 Sol.

На 22 септември 2026 г., около час след Claude Opus 5.5, OpenAI пусна два нови модела: GPT-6 Sol и GPT-6 Luna. И двата струват наполовина от предшествениците си.

Три модела, три роли

Семейството GPT-6 вече има три нива:

Модел Роля Цена (вход / изход, $ за милион токена)
GPT-6 Astra Най-умният, за най-трудната работа 10 / 50
GPT-6 Sol Работният кон - умен и на добра цена 2 / 10
GPT-6 Luna Най-евтиният, за големи обеми 0,10 / 0,50

За сравнение: новият Claude Opus 5.5 е 4 $ / 20 $. Sol е два пъти по-евтин от него.

Luna при 0,10 $ за милион входни токена е един от най-евтините модели, които OpenAI е пускала изобщо.

Какво твърди OpenAI

По думите на OpenAI Sol и Luna са обучени с подобни методи като Astra. Трябва да носят голяма част от силата му, но по-бързо и по-евтино.

Тестовете в обявата наблягат на едно: цена на свършена задача.

  • AutomationBench (бизнес автоматизации): Sol решава 33,2% от задачите при 0,27 $ на задача. Claude Opus 5 на максимално усилие решава 26,9% при 11 пъти по-висока цена.
  • DeepSWE (реален софтуерен код): Sol стига 68,8%, на 1,1 пункта от Claude Fable 5, при около 80% по-ниска цена.
  • Luna на същия тест стига 66,6% - колкото Opus 5 и Fable 5 на средно усилие, но с 93-96% по-евтино.
  • Фактите: по вътрешния тест на OpenAI Sol прави около два пъти по-малко фактически грешки от предшественика си.

Една уговорка: OpenAI се сравнява с Claude Opus 5 и Fable 5, не с новия Opus 5.5, който излезе същия ден.

Какво показват независимите тестове

Тук картината е по-интересна.

Paweł Huryn пусна моделите на реална работа: две кодови бази със 105 скрити бъга. Резултатът:

Модел (макс. усилие) Оправени бъгове Цена
GPT-6 Astra 45 33,04 $
GPT-5.6 Sol (предишният) 43,5 95,25 $
Claude Opus 5.5 41,7 58,53 $
GPT-6 Sol 29,3 9,93 $

На пръв поглед Sol е стъпка назад - намира по-малко бъгове дори от предшественика си.

Но всеки намерен бъг струва около 0,34 $. При Opus 5.5 същият бъг струва 1,40 $, а при стария Sol - 2,19 $.

Artificial Analysis стига до същото. В общия им индекс Sol е на 48 точки, под Astra (53) и Opus 5.5 (58). Но една задача му струва 1,06 $, а на Opus 5.5 - близо 6 $.

Sam Altman го казва директно: цената на задача е мярката, която има значение.

Мнението на Иван Цукев, основател на Аула

Много е интересно. Astra, основният модел на GPT-6, е най-умният и най-мощният модел. А сега ни дават още два. Sol е умен и с добра цена - работен кон. Luna е много, много евтин и ще е интересен за тежки задачи, които не изискват чак такъв интелект, но изискват оптимизация на разходите.

Същото се вижда и при двете лаборатории. Имат много мощни вътрешни модели, които още не са пуснати, и ги използват, за да направят текущите си модели много по-ефективни.

Така и от OpenAI, и от Anthropic виждаме много по-бързи модели, много по-ефективни като изразходване на токени и с по-добра цена. Използват най-силните си вътрешни модели, за да оптимизират и да пускат нови версии на популярните публични модели - но много, много по-ефективни.

Хората от OpenAI го потвърждават. Tibo, който води Codex, пише, че това е „възможно само когато имаш невероятни модели на върха“, с които да подобриш всичко останало.

Anthropic направиха същото с Opus 5.5: нивото на по-скъпия Fable 5.1, на по-ниска цена.

Кой модел за какво

  • Astra - когато грешката е скъпа и качеството е всичко.
  • Sol - всекидневна работа: анализи, текстове, код. Simon Willison вече го ползва по подразбиране в Codex.
  • Luna - големи обеми: класифициране на хиляди имейли, извличане на данни, чатботове. Там цената на заявка решава всичко.

Къде можете да ги ползвате: в ChatGPT Work и Codex за платените планове (Plus, Pro, Business, Enterprise, Edu). Потребителите на Free и Go могат да пробват Luna в desktop приложението. В обикновения чат още ги няма.

Какво значи това за вас

Моделите стават по-евтини всеки месец. Изборът на модел вече е въпрос на сметка, не само на качество.

Печелят фирмите, които знаят коя задача към кой модел да пратят. Това е умение, не абонамент.

Ако ползвате ChatGPT в работата си, курсът „Тайните на ChatGPT“ ви дава точно тази преценка. Ако тепърва започвате, AI Старт е основата.

А уебинарът на Любо? Тестваме Blender със Sol.

Ако работата се върши и без тежката артилерия, уебинар ще има. Точно за това е създаден този модел.

Коментари

Няма коментари още — бъди първи.