Преди няколко седмици Любо, нашият UI/UX дизайнер, обяви на екипа уебинар: 3D моделиране в Blender с GPT-6 Astra.
Бяхме го тествали. Astra прави страхотни 3D модели - от описание до готов обект в Blender. Много яки неща.
Любо седна да подготви уебинара. След един-два опита акаунтът му беше изпразнен.
Моделът работеше. Просто харчеше токени с темпото на тежка артилерия. Уебинарът отпадна.
Сега имаме втори шанс. И той се казва GPT-6 Sol.
На 22 септември 2026 г., около час след Claude Opus 5.5, OpenAI пусна два нови модела: GPT-6 Sol и GPT-6 Luna. И двата струват наполовина от предшествениците си.
Три модела, три роли
Семейството GPT-6 вече има три нива:
| Модел | Роля | Цена (вход / изход, $ за милион токена) |
|---|---|---|
| GPT-6 Astra | Най-умният, за най-трудната работа | 10 / 50 |
| GPT-6 Sol | Работният кон - умен и на добра цена | 2 / 10 |
| GPT-6 Luna | Най-евтиният, за големи обеми | 0,10 / 0,50 |
За сравнение: новият Claude Opus 5.5 е 4 $ / 20 $. Sol е два пъти по-евтин от него.
Luna при 0,10 $ за милион входни токена е един от най-евтините модели, които OpenAI е пускала изобщо.
Какво твърди OpenAI
По думите на OpenAI Sol и Luna са обучени с подобни методи като Astra. Трябва да носят голяма част от силата му, но по-бързо и по-евтино.
Тестовете в обявата наблягат на едно: цена на свършена задача.
- AutomationBench (бизнес автоматизации): Sol решава 33,2% от задачите при 0,27 $ на задача. Claude Opus 5 на максимално усилие решава 26,9% при 11 пъти по-висока цена.
- DeepSWE (реален софтуерен код): Sol стига 68,8%, на 1,1 пункта от Claude Fable 5, при около 80% по-ниска цена.
- Luna на същия тест стига 66,6% - колкото Opus 5 и Fable 5 на средно усилие, но с 93-96% по-евтино.
- Фактите: по вътрешния тест на OpenAI Sol прави около два пъти по-малко фактически грешки от предшественика си.
Една уговорка: OpenAI се сравнява с Claude Opus 5 и Fable 5, не с новия Opus 5.5, който излезе същия ден.
Какво показват независимите тестове
Тук картината е по-интересна.
Paweł Huryn пусна моделите на реална работа: две кодови бази със 105 скрити бъга. Резултатът:
| Модел (макс. усилие) | Оправени бъгове | Цена |
|---|---|---|
| GPT-6 Astra | 45 | 33,04 $ |
| GPT-5.6 Sol (предишният) | 43,5 | 95,25 $ |
| Claude Opus 5.5 | 41,7 | 58,53 $ |
| GPT-6 Sol | 29,3 | 9,93 $ |
На пръв поглед Sol е стъпка назад - намира по-малко бъгове дори от предшественика си.
Но всеки намерен бъг струва около 0,34 $. При Opus 5.5 същият бъг струва 1,40 $, а при стария Sol - 2,19 $.
Artificial Analysis стига до същото. В общия им индекс Sol е на 48 точки, под Astra (53) и Opus 5.5 (58). Но една задача му струва 1,06 $, а на Opus 5.5 - близо 6 $.
Sam Altman го казва директно: цената на задача е мярката, която има значение.
Мнението на Иван Цукев, основател на Аула
Много е интересно. Astra, основният модел на GPT-6, е най-умният и най-мощният модел. А сега ни дават още два. Sol е умен и с добра цена - работен кон. Luna е много, много евтин и ще е интересен за тежки задачи, които не изискват чак такъв интелект, но изискват оптимизация на разходите.
Същото се вижда и при двете лаборатории. Имат много мощни вътрешни модели, които още не са пуснати, и ги използват, за да направят текущите си модели много по-ефективни.
Така и от OpenAI, и от Anthropic виждаме много по-бързи модели, много по-ефективни като изразходване на токени и с по-добра цена. Използват най-силните си вътрешни модели, за да оптимизират и да пускат нови версии на популярните публични модели - но много, много по-ефективни.
Хората от OpenAI го потвърждават. Tibo, който води Codex, пише, че това е „възможно само когато имаш невероятни модели на върха“, с които да подобриш всичко останало.
Anthropic направиха същото с Opus 5.5: нивото на по-скъпия Fable 5.1, на по-ниска цена.
Кой модел за какво
- Astra - когато грешката е скъпа и качеството е всичко.
- Sol - всекидневна работа: анализи, текстове, код. Simon Willison вече го ползва по подразбиране в Codex.
- Luna - големи обеми: класифициране на хиляди имейли, извличане на данни, чатботове. Там цената на заявка решава всичко.
Къде можете да ги ползвате: в ChatGPT Work и Codex за платените планове (Plus, Pro, Business, Enterprise, Edu). Потребителите на Free и Go могат да пробват Luna в desktop приложението. В обикновения чат още ги няма.
Какво значи това за вас
Моделите стават по-евтини всеки месец. Изборът на модел вече е въпрос на сметка, не само на качество.
Печелят фирмите, които знаят коя задача към кой модел да пратят. Това е умение, не абонамент.
Ако ползвате ChatGPT в работата си, курсът „Тайните на ChatGPT“ ви дава точно тази преценка. Ако тепърва започвате, AI Старт е основата.
А уебинарът на Любо? Тестваме Blender със Sol.
Ако работата се върши и без тежката артилерия, уебинар ще има. Точно за това е създаден този модел.
Коментари
Няма коментари още — бъди първи.