OpenAI пусна публично GPT-5.6 Sol, своя най-мощен модел. На специализиран хардуер той достига до 750 токена в секунда: около десет пъти повече от обичайната скорост на моделите от този клас. Моделът стана достъпен за всички на 9 юли 2026 г., след ограничен период на предварителен достъп, започнал на 26 юни. За бизнеса, който изгражда автоматизирани помощници, това е разликата между инструмент, който кара служителя да чака, и такъв, който отговаря на момента.
Какво представлява новият модел
GPT-5.6 Sol е върхът на ново семейство от три модела на OpenAI: Sol за най-сложните задачи, Terra за ежедневна работа и Luna за бързи и евтини операции. В новата схема за именуване числото обозначава поколението, а имената Sol, Terra и Luna показват нивото на способности. Според официалното съобщение на OpenAI, Terra предлага производителност, съизмерима с предишния GPT-5.5, но на половин цена.
Sol въвежда два нови режима на разсъждение, които го отличават от останалите. Първият, наречен max, дава на модела повече време да обмисли един труден проблем в единна последователност. Вторият, ultra, работи различно: той разделя задачата на части и пуска няколко под-агента (отделни процеси, които работят едновременно), след което обединява резултатите им. Именно този режим доведе до рекордния резултат на модела в тестовете за програмиране.
Скоростта, която променя правилата
Най-важната новина не е в оценките от тестовете, а в скоростта на генериране. OpenAI пуска GPT-5.6 Sol на хардуера на Cerebras (компания, която произвежда чипове с размер на цяла силициева пластина, специално за изкуствен интелект). Тази конфигурация достига до 750 токена в секунда. За сравнение, типичните графични процесори обслужват модели от този клас с около 70 токена в секунда, което прави Cerebras около десет пъти по-бърз.
Тази разлика има значение именно за автоматизираните работни потоци. Когато един помощник изпълнява задача на няколко стъпки, всяка от които изисква генериране на текст, забавянето се натрупва. Помощник, който на обикновен хардуер завършва заявка за половин минута, на бързата конфигурация я приключва за секунди. Достъпът до бързата версия е ограничен в началото само до избрани клиенти, докато Cerebras разширява капацитета си.
Скоростта обаче идва с цена. Бързият вариант, наречен Sol Fast, е отделно платено ниво: 12,50 долара за милион входящи токена и 75 долара за милион изходящи. Това е около два пъти и половина над стандартната тарифа. За стандартния Sol цената е пет долара за милион входящи и 30 долара за милион изходящи токена.
Какво показват тестовете
На теста Terminal-Bench 2.1, който измерва способността за работа с команден ред, Sol в стандартен режим постигна 88,8%. С режима ultra резултатът се вдигна до 91,9%. Тук е важно да се направи уточнение: по-високият резултат идва от режима с под-агенти. Затова той не е пряко сравним с оценки на модели, работещи с една последователност.
OpenAI посочва подобрения и в други области. В биологията, на теста GeneBench v1, Sol постига по-добри резултати от GPT-5.5, като използва по-малко токени. В киберсигурността моделът е конкурентен на предишния модел Mythos Preview, но само с около една трета от изходящите токени. Тези числа за ефективност имат практическо значение: по-малко токени означава по-ниска сметка за същия резултат.
Струва си да се отбележи, че моделът не води по всички показатели. На теста SWE-Bench Pro, който проверява реалната работа по програмиране, Sol постига 64,6% и изостава от конкурентни модели. Тоест изборът на модел зависи от конкретната задача, а не от единна оценка.
Защо OpenAI пусна модела на два етапа
Публичното пускане дойде след необичайно забавяне. OpenAI първо предостави достъп до GPT-5.6 само на около 20 доверени партньори на 26 юни, а широкото пускане беше отложено. Причината, според съобщенията около пускането, е допълнителна проверка от американското Министерство на търговията заради способностите на модела в областта на киберсигурността. След одобрението на 9 юли моделът стана достъпен през ChatGPT, инструмента за програмиране Codex и програмния интерфейс на OpenAI.
Какво означава това за бизнеса
За компания, която използва или планира да използва AI помощник за обслужване на клиенти или за вътрешни задачи, най-практичната промяна е скоростта. Досега автоматизираните помощници, които изпълняват задачи на няколко стъпки, често бяха твърде бавни за разговор в реално време. При 750 токена в секунда такива помощници стават използваеми в жив разговор с клиент, при обработка на документи или при бърза проверка на данни.
Тук обаче е важно да се преценят три неща:
- Цената спрямо ползата. Бързата версия струва около два пъти и половина над стандартната. За разговор с клиент, който чака отговор, тази скорост си заслужава. За задачи, които се изпълняват през нощта, тя е излишна.
- Изборът на ниво. За голяма част от ежедневната работа Terra предлага качество, близко до предишното поколение, на половин цена. Не всяка задача изисква най-скъпия модел.
- Достъпността в България. Моделът работи през програмния интерфейс на OpenAI и през ChatGPT, които са достъпни за българските потребители. Интерфейсът на самия модел е на английски, но моделите от този клас обработват и български текст.
За собственик на малък бизнес изводът е конкретен: не търсете най-мощния модел, а най-евтиния, който върши работата. Ако имате процес, при който клиент или служител чака отговор, бързата версия има смисъл. Ако обработвате данни без човек, който чака, стандартните нива са по-разумни.
Какво следва
OpenAI обяви, че достъпът до бързата версия на Cerebras ще се разширява постепенно, с добавяне на капацитет. Компанията също така пусна нова работна среда, ChatGPT Work, която обединява разговорния помощник и инструмента за програмиране. За бизнеса в България следващата стъпка е да провери коя от трите версии отговаря на конкретните му задачи, преди да пренасочи работни потоци към новия модел.