GPT‑5 е представен като най-новата версия на AI системата, с по-висока обща интелигентност и по-добра практическа полезност в ежедневни задачи. Моделът обединява бърз режим и режим за по-задълбочено разсъждение, като автоматично избира подхода според контекста.
Една обединена система с „рутер“ за избор на режим
GPT‑5 е описан като единна система, която включва: основен „умен и ефективен“ модел за повечето въпроси, отделен модел за по-дълбоко разсъждение („GPT‑5 thinking“) при трудни проблеми и компонент в реално време, който решава кой режим да се използва. Изборът зависи от типа разговор, сложността, нуждата от инструменти и изричното намерение на потребителя (например указание като „помисли задълбочено“).
Рутерът се дообучава постоянно по реални сигнали, включително кога потребителите сменят модели, кои отговори предпочитат и измерена коректност. При достигане на лимитите за използване заявките се поемат от „mini“ версии на моделите, а като следваща стъпка се планира тези възможности да бъдат интегрирани в един модел.
Подобрения в най-честите употреби: код, текстове и здраве
GPT‑5 е позициониран като по-полезен за реални казуси, с фокус върху намаляване на халюцинациите, по-добро следване на инструкции и ограничаване на прекомерната угодническа тоналност. Акцентът е поставен върху три от най-популярните приложения в ChatGPT: писане, програмиране и въпроси, свързани със здравето.
GPT‑5 е замислен да решава кога да отговори бързо и кога да вложи повече разсъждение, за да даде по-експертен резултат, без потребителят задължително да избира ръчно режим.Програмиране
Моделът е представен като най-силния досега за код, с отчетливи подобрения при сложна front‑end генерация и дебъгване на по-големи хранилища (repositories). Според описанието може да създава уебсайтове, приложения и игри с внимание към визуалния дизайн, включително по-добро усещане за разстояния, типография и „бяло пространство“.
Като пример е дадена едностранична игра „Jumping Ball Runner“, описана с изисквания за нарастваща скорост, проследяване на висок резултат, бутон за повторен опит, звуци, цветен интерфейс, паралакс фонове и „карикатурни“ персонажи.
Креативно писане и редакция
GPT‑5 е описан като по-способен партньор за писане, който превежда сурови идеи в по-цялостни текстове с ритъм и литературна дълбочина. Подчертана е по-надеждна работа при по-двусмислена структура и по-свободни форми (например свободен стих), както и по-практическа помощ при ежедневни задачи като писане и редактиране на доклади, имейли и мемо.
Здраве
GPT‑5 е представен като най-добрия модел в серията за здравни въпроси и получава значително по-високи резултати на HealthBench — оценка, базирана на реалистични сценарии и критерии, дефинирани от лекари. Според описанието моделът по-често действа като „мисловен партньор“: маркира потенциални рискове, задава уточняващи въпроси и се адаптира към контекста на потребителя, нивото на знания и географията.
Изрично се уточнява, че ChatGPT не замества медицински специалист, а е инструмент за разбиране на резултати, формулиране на правилни въпроси към лекари и сравняване на варианти при вземане на решения.
Бенчмаркове, мултимодалност и работа с инструменти
GPT‑5 е отчетен като по-силен в академични и човешки оценявани тестове, особено по математика, програмиране, визуално разбиране, здраве и мултимодални задачи. Посочени са конкретни резултати: 94.6% на AIME 2025 без инструменти; 74.9% на SWE-bench Verified и 88% на Aider Polyglot; 84.2% на MMMU; 46.2% на HealthBench Hard. За GPT‑5 pro е посочен резултат 88.4% на GPQA без инструменти.
Отделно се акцентира върху напредък в следването на инструкции и „agentic“ използването на инструменти — способности за изпълнение на многостъпкови заявки, координация между различни инструменти и адаптиране при промяна на контекста.
В мултимодалните оценки се подчертава по-добро разсъждение върху изображения и други нетекстови входове — например интерпретация на графики, обобщаване на снимка на презентация или отговори по диаграми. Посочено е и твърдение за по-ефективно „мислене“: при оценки GPT‑5 (с разсъждение) постига по-добри резултати от OpenAI o3 с 50–80% по-малко изходни токени в направления като визуално разсъждение, „agentic“ кодиране и научни задачи на ниво магистър/доктор.
Обучението е извършено на Microsoft Azure AI суперкомпютри.
Надеждност, честност, безопасност и достъп
Като ключова цел е поставена по-висока надеждност при реални въпроси. При включено уеб търсене върху анонимизирани заявки, представителни за трафик в ChatGPT, е заявено, че GPT‑5 дава около 45% по-малко фактически грешки спрямо GPT‑4o, а при „мислене“ — около 80% по-малко фактически грешки спрямо OpenAI o3. При отворени тестове за фактологичност (LongFact и FActScore) се твърди, че „GPT‑5 thinking“ намалява халюцинациите рязко — приблизително шест пъти спрямо o3.
Отделен фокус е „по-честно“ поведение при невъзможни или недоопределени задачи. Като пример е описан тест с премахнати изображения от CharXiv, при който OpenAI o3 дава уверени отговори за несъществуващи изображения в 86.7% от случаите, докато GPT‑5 — в 9%. В разговори, представителни за реален трафик, е отчетено намаление на „измамно“ поведение от 4.8% при o3 до 2.1% при GPT‑5 разсъждаващи отговори.
По отношение на безопасността се въвежда подход „safe completions“, който цели моделът да дава възможно най-полезен отговор в рамките на ограниченията, включително частични или по-високо ниво обяснения при двойнo предназначение (dual-use) теми. Ако се налага отказ, моделът трябва да обяснява причината и да предлага безопасни алтернативи.
Съобщава се и за мерки за биологичен риск: „GPT‑5 thinking“ е третиран като High capability в биологичния и химичния домейн и са приложени предпазни механизми. Посочени са 5,000 часа red‑teaming с партньори като CAISI и UK AISI, както и многослоен защитен стек (моделиране на заплахи, обучение да не изкарва вредно съдържание чрез safe completions, постоянни класификатори и монитори за разсъждение, и механизми за прилагане).
В стила се цели по-малко прекомерно съгласяване (sycophancy), по-малко ненужни емоджита и по-умерени последващи въпроси. В таргетирани оценки е посочено намаление на угоднически отговори от 14.5% до под 6%.
Паралелно се добавят четири предварително зададени „личности“ в изследователски преглед за всички потребители: Cynic, Robot, Listener и Nerd — опционални, с настройка по всяко време и първоначално за текстов чат, а по-късно и за Voice.
Представен е и GPT‑5 pro, който заменя OpenAI o3‑pro и използва по-дълго разсъждение с мащабирана паралелна изчислителна мощ. В оценки върху над 1000 реални промпта за разсъждение външни експерти предпочитат GPT‑5 pro пред „GPT‑5 thinking“ в 67.8% от случаите, с 22% по-малко големи грешки и силни резултати в здраве, наука, математика и програмиране.
GPT‑5 става модел по подразбиране в ChatGPT за влезли потребители, като заменя GPT‑4o, OpenAI o3, OpenAI o4-mini, GPT‑4.1 и GPT‑4.5. Платените потребители могат да изберат „GPT‑5 Thinking“ от менюто или да поискат изрично по-задълбочено разсъждение в промпта.
Достъпът се разширява към Plus, Pro, Team и Free потребители, а за Enterprise и Edu е планирано да последва. Разликата между безплатен и платен достъп е основно в обема използване: Pro включва неограничен достъп до GPT‑5 и достъп до GPT‑5 pro; Plus предлага по-високи лимити спрямо Free; Team, Enterprise и Edu получават щедри организационни лимити. След изчерпване на лимита при безплатните потребители се преминава към GPT‑5 mini — по-малък и по-бърз модел. GPT‑5 е наличен и в Codex CLI за Pro, Plus и Team след вход с ChatGPT.
Какво означава това
- По-малко „превключване“ от потребителя: системата сама решава кога да отговори бързо и кога да разсъждава по-дълго.
- По-силен фокус върху практическа полезност: подобренията са насочени към реални задачи като писане, код и теми за здраве.
- По-нисък риск от фактически грешки: заявени са измерими намаления на халюцинации и грешки спрямо GPT‑4o и OpenAI o3.
- По-ясни ограничения: моделът е трениран да признава когато не може да изпълни задача или липсват нужни данни/инструменти.
- Различни нива на достъп: всички получават GPT‑5, но лимитите и наличността на GPT‑5 pro зависят от абонамента.
