Эксперты оценили GPT-5: программистам пора задуматься о смене работы

Компания-разработчик нейросетей OpenAI 7 августа представила последнюю версию своей нейросети ChatGPT. ChatGPT-5 обещает быть более мощным, более умным, вмещать и обрабатывать большие объёмы информации и вообще стать настоящим умным помощником, а не просто нейросетью для вопросов и ответов. Так это или нет, пользователи скоро увидят на практике, а пока к новой модели у экспертов ещё есть вопросы. Что изменилось в ChatGPT, стоит ли торопиться тестировать пятую версию и меняет ли новая модель правила игры в ИИ — выяснил «Секрет». Что принципиально нового в ChatGPT-5 «Вышла GPT-5 — мощнейшая ИИ-система в мире» — такие заголовки СМИ появились сразу после презентации OpenAI. Ложку дёгтя, правда, подлил Илон Маск, заявивший, что четвёртая версия Grok ещё неделю назад превосходила по показателям новую версию ChatGPT, а к концу года пообещал выкатить пятую, которая «будет невероятно хороша». При этом он отметил, что новая модель ChatGPT действительно прорывная. «OpenAI собирается съесть Microsoft живьем», — написал он в соцсети X (заблокирована в РФ). Какие же основные отличия этой «прорывной модели»? От модели к системе Новая GPT-5 не просто нейросетевой интерфейс, а именно ИИ-система, ядро для агентов. Она способна проанализировать запрос пользователя, самостоятельно выбрать алгоритм, который лучше с ним справится, и спланировать все шаги к цели без уточняющих запросов. Это не просто апгрейд, а качественный скачок в «мышлении» модели и окончательная смена схемы от «спросил — получил ответ» к «поставил задачу — получил результат». При этом пользователю не придётся вручную переключаться между моделями (у каждой из которых свои слабые и сильные стороны для разных задач). И даже специально задавать режим рассуждений не обязательно. Всего пока представлено четыре модели из заявленных шести: - Базовая GPT-5. - GPT-5 Pro — более мощная и тяжеловесная, доступна только по подписке за 200 $. - GPT-5 mini — облегчённая версия с балансом производительности, доступна по api. - GPT-5 nano — сверхбыстрая версия для задач с низкой задержкой ответа, доступна по api. Большая глубина рассуждений Даже самая «лёгкая» GPT-5 nano с максимальными рассуждениями в некоторых тестах приближается к уровню o3 и o4-mini. Вообще же в тестах-бенчмарках, по утверждению OpenAI, пятая GPT легко обходит всех конкурентов по креативности, пониманию сложных промптов и написании кода. «GPT-3 ощущался как разговор со старшеклассником… GPT-4 — как разговор со студентом колледжа. GPT-5 — это первый случай, когда действительно общаешься с экспертом PhD-уровня», — заявил CEO OpenAI Сэм Альтман в ходе презентации. Отмечается, что особого прорыва модель достигла в медицине — теперь ИИ гораздо точнее ставит сложные диагнозы. При этом в зависимости от сложности задачи объём рассуждений может отличаться в разы. В рейтинге LMArena, где пользователи вслепую оценивают ответы нейросетей, GPT-5 заняла первое место, опередив o3 и Gemini 2.5 Pro от Google. А вот в сравнении только GPT-5 и Gemini 2.5 Pro модель OpenAI побеждает лишь в трети случаев. Долгие беседы Модель способна оперировать диалогами объёмом в десятки тысяч слов, не теряя контекст. Теперь не нужно повторять и постоянно напоминать какие-то ранее обговорённые вещи — она «помнит» ход разговора и умеет выдерживать длинные нити размышлений. Тексты и стилизации Эксперт Innostage Александр Лебедев отметил, что GPT-5 пишет тексты лучше, чем прошлые модели серии или конкуренты. В том числе поэзию и стилизованные тексты. Вот, например, что она сочинила на запрос «Напиши параграф в стиле Бабеля про то как АИ вытесняет людей с работы»: Серверная дышала стеклянным холодом, зелёный свет мониторов лизал пустые столы. Алгоритм жевал чужие обязанности — тихо, ровно, без слюны, как хорошая лошадь овёс. Мужики выходили, держа в пальцах пропуска, и карточки их остывали, становясь лёгкими, как рыбья чешуя. Воздух пах пересушенным пластиком, кофе вчерашней смены и чуть — мокрой шерстью дождя с улицы. Машина принимала отчёты без благодарности, выплёвывала цифры, и цифры шли дальше, за стены, в тёплые карманы невидимых. Один старик постоял у стекла, потрогал его кулаком — там шёл тихий ток, и ток не заметил его. Мы слушали этот гул, в котором не было ни радости, ни злобы, и становились прозрачными для работы, как люди на фотографии, что долго лежала на солнце. И всё-таки в груди у каждого ещё трудилось что-то живое — маленький горячий мотор, которому пока не сказали, что он лишний. Самый простой кодинг Новая версия способна создавать сложные приложения всего по одному промпту. Разработчики утверждают, что чат-бот не теряется в длинном контексте и аккуратно работает с инструментами и файлами. По оценкам исследователей, это самая мощная нейросеть для написания кода из существующих на рынке. Она может выстраивать более сложные цепочки действий и писать более сложный код в одном стиле. Эксперты отмечают, что развитие ИИ до такого уровня ставит серьёзный вызов для программистов: теперь чтобы конкурировать с ИИ, нужно соответствовать, расширять специализацию и стараться вдвое усерднее. Выбор стиля общения Предыдущие версии ChatGPT часто критиковали за излишний «подхалимаж». Он безбожно льстил пользователю и был склонен соглашаться с ним, даже когда он говорил очевидно неверные вещи. Пятый GPT не поддакивает и не льстит пользователю, если он сам того не просит. В новой версии можно выбрать предпочтительный стиль общения: - Откройте в меню пользователя «Настроить ChatGPT». - В пункте «Какой личностью должен обладать ChatGPT?» выберите один из пяти базовых вариантов. По умолчанию там стоит «весёлый и адаптивный», но можно выбрать вдумчивого слушателя, критического циника, восторженного гика-исследователя или эффективного робота без сантиментов. - Дополнительно настроить GPT под себя можно, прописав в окне ниже черты его характера — своими словами или выбрав из предлагаемых. Кстати, персонализировать можно не только «голос» ИИ, но и дизайн чата, выбрав цвет фона. А ещё нейросеть стала более аргументировано отказывать пользователям, если те вводят небезопасные (неэтичные, нелегальные) запросы. Она не просто скажет, что это запрещено политикой OpenAI, но и укажет, что именно в запросе её смутило. На тестирование её безопасности потратили около 9000 часов. Интеграция в другие сервисы Один из способов авторизации в ChatGPT — через аккаунт в Google. В новой версии эти два мегасервиса ещё больше сближают: ещё до середины августа GPT-5 интегрируют в Gmail и Google Календарь. Почтой и расписанием можно будет управлять прямо в чате: например, задать нейросети команду «пометить все письма прочитанными» будет быстрее, чем отмечать их вручную на каждой странице почты. Мультимодальность ChatGPT-5 умеет работать не только с текстом, но и с изображениями, видео и аудио. Анализирует графики, видео-фрагменты, аудио — всё в едином диалоге, сохраняя контекст. Меньше галлюцинаций? По заверениям разработчиков, новая модель спроектирована так, чтобы гораздо реже «галлюцинировать» — выдумывать несуществующие факты, совершать ошибки и т. п. Модель лучше понимает и исправляет свои ошибки. При этом совсем от галлюцинаций она не застрахована. Даже на презентации Сэма Альтмана GPT-5 пару раз «села в лужу». Подводные камни А теперь стоит пояснить, что заявления разработчиков, результаты тестов и позиционирование модели — это ещё не всё. Есть ещё пользовательский опыт — как GPT-5 показывает себя «в полях». И вот тут-то релиз обернулся полным провалом. Reddit и профильные форумы завалены сообщениями пользователей ChatGPT, негодующих по поводу изменений. Они просят вернуть старые версии, которые стали недоступны с выкаткой новой, и говорят, что «новая, мощная и думающая» GPT-5 в разы хуже и глючнее многих предыдущих версий. Она не такая приятная в общении, как GPT-4o, не такая креативная, как GPT-4.5, и не такая умная, как OpenAI o3. Многие связывают своё разочарование с тем, что в OpenAI сильно завысили ожидания от этой модели. Перед запуском Сэм Альтман намекал, что новая версия будет подобна «Звезде Смерти» в мире ИИ, и сравнивал общение с ней с разговором с учёным. Вместо этого ChatGPT теперь разговаривает «так, как будто его ударили по голове», жалуются пользователи. Возможно, выкатка новой модели невольно повысила процент галлюцинаций в предыдущей GPT 4.1, которая по ответу той же нейросети пока остаётся основной для бесплатного пользования. При этом этом некоторые новые функции уже внедрили в интерфейс. Наложение новой модели на старую вызвала снежный ком ошибок. Например, российские пользователи ChatGPT заметили, что он стал хуже говорить по-русски. Модель путается в родах и падежах и придумывает несуществующие слова, например, «уважаственно» вместо «уважительно». Также в бесплатной версии начались глюки с ответами, особенно в чатах с долгими диалогами. Он может забыть, что вы ему задавали ранее, ответить на какой-то из старых вопросов вместо нового, несколько раз переспросить новый или вообще выдать вам ответ «из чужого чата», который вы даже не запрашивали, вместо ответа на ваш вопрос. Отмечается также, что: - В GPT-5 сломано распределение запросов и почти все сообщения летят на слабый GPT-5-mini; - «Думающий» режим на деле не работает — GPT-5 думает даже над самыми сложными задачами не дольше одной минуты и выдаёт упрощённые ответы; Как пояснил эксперт по нейросетям Илья Народицкий, это может быть связано с тем, что до 14 августа развёртывание продолжается и могут возникать системные ошибки, которые в реальном времени правят разработчики. Так что тестировать обновление лучше после этой даты. А пока топы OpenAI собираются на открытую сессию для обсуждения, что же пошло не так. Оценки экспертов Эксперты сошлись в том, что если результаты предварительных тестов верны, новая версия потенциально лучше предыдущих и может заметно продвинуть вперёд и пользовательский опыт, и применимость для бизнес-задач. Но вот принципиально мир ИИ она не перевернёт. Основные принципы и тренды здесь уже сформировались, и появилось много конкурентных моделей, которые справляются с похожими задачами плюс-минус на равных.
Эксперты оценили GPT-5: программистам пора задуматься о смене работы

Сообщает secretmag.ru

 

Опубликовано: 03:36, 14.08.2025

 

Новость из рубрики: Бизнес, Промышленность, Энергетика

 

Поделиться новостью: Поделиться новостью в Facebook Поделиться новостью в Twittere Поделиться новостью в VK Поделиться новостью в Pinterest Поделиться новостью в Reddit

 

Топ Новости Недели Топ Новости Недели

 

Декабрь - пора задуматься о цветнике: эти 8 великолепных цветов можно посадить сейчас 22:36, 16 Дек Декабрь - пора задуматься о цветнике: эти 8 великолепных цветов можно посадить сейчас Прогород Декабрь за окном — метель, сугробы, короткий день. Кажется, самое время забыть о даче до весны. Но опытные цветоводы именно сейчас достают я...

Эксперты РАНХиГС оценили эффективность решений G20 05:36, 16 Дек Эксперты РАНХиГС оценили эффективность решений G20 Члены организации успешно решают вызовы глобального развития, но не вопросы, связанные с финансовыми выгодами...

Условия работы eSIM в России серьезно изменили. Настолько, что пора возвращаться на пластик! 19:36, 02 Сен Условия работы eSIM в России серьезно изменили. Настолько, что пора возвращаться на пластик! Технология eSIM с каждым годом проникает в разные страны и расширяется по миру. Мобильные операторы постепенно просекают экономию на чипах и пластике...

Эксперты К2Тех оценили рынок отечественных Wi-Fi решений 14:36, 20 Дек Эксперты К2Тех оценили рынок отечественных Wi-Fi решений Компания К2Тех совместно с независимыми экспертами из российских компаний провела исследование отечественных Wi-Fi решений. Специалисты сравнили 12 к...

Эксперты оценили влияние дефицита кадров на удовлетворенность работой 05:36, 16 Дек Эксперты оценили влияние дефицита кадров на удовлетворенность работой Благополучие россиян выросло, но увеличились переработки и переток в низкоквалифицированные специальности...

Эксперты Puget Systems оценили надёжность процессоров Intel и AMD 10:36, 03 Фев Эксперты Puget Systems оценили надёжность процессоров Intel и AMD Американская компания Puget Systems, что собирает компьютеры на заказ, опубликовала ежегодный отчёт о надёжности комплектующих. Процессоры: Intel и A...

Экономика: Эксперты оценили работу Банка России над ошибками 10:36, 17 Ноя Экономика: Эксперты оценили работу Банка России над ошибками Глава Банка России Эльвира Набиуллина провела честную работу над ошибками. Она назвала две ошибки регулятора. Во-первых, он слишком медленно повышал ...

Эксперты оценили потенциал экспорта сахара из РФ в 2025/26 сельхозгоду в 1,4-1,5 млн т 09:36, 24 Дек Эксперты оценили потенциал экспорта сахара из РФ в 2025/26 сельхозгоду в 1,4-1,5 млн т Потенциал экспорта сахара из России в 2025/26 сельхозгоду с учетом накопленных запасов оценивается в 1,4-1,5 млн тонн....

13:36, 07 Июл Эксперты оценили готовность к запуску беспилотного транспорта в России Россия близка к внедрению беспилотного общественного транспорта – техническая готовность проектов оценивается в 70-85%. С таким заявлением на междуна...

08:36, 11 Апр Финансовая пирамида или госсектор: эксперты оценили устойчивость выплат в СФР Российская пенсионная система превращается в классическую "финансовую пирамиду", где фундамент из частного бизнеса крошится под весом государственных...

04:36, 14 Мар Эксперты оценили Geely Emgrand 2023 года после 400 тысяч пробега Всё время седан работал в службе такси, а обслуживался парком и водителями, то есть самостоятельно. Пробег машины — 394 425 километров, а её реальная...

11:36, 08 Авг Самозанятые не скидывались? Эксперты оценили риски введения для них обязательных пенсионных взносов Федерация независимых профсоюзов России (ФНПР) выступила с инициативой перевести самозанятых на обязательную модель формирования пенсии. Согласно поз...

21:36, 10 Апр Эксперты оценили возможность фиксированных цен на цифровых платформах в контексте свободы рынка Инициатива Минэкономики по введению единой стоимости товаров на цифровых платформах вызвала активную дискуссию в экспертном сообществе. Ведомство пре...

16:36, 26 Май Сработает ли самозапрет против зависимости? Эксперты оценили риски новых правил для казино С 1 сентября 2026 года в российском правовом поле появится механизм самозапрета на участие в азартных играх. Государство внедряет инструмент, призван...

20:36, 28 Июн ChatGPT и Gemini: Эксперты оценили стоимость одной текстовой сессии в 0,24 ватт-часа Цифровая инфраструктура перегрета. За удобство нейросетевых ответов Gemini или ChatGPT мир платит энергетическим дефицитом. Одна текстовая сессия пот...

01:36, 23 Дек Работы по восстановлению Янтарной мануфактуры в Калининграде оценили в 600 млн рублей Музей Мирового океана в Калининграде рассчитывает получить средства из регионального бюджета на восстановление Янтарной мануфактуры. Работы оценивают...

18:36, 03 Май Стартапы находят путь к рынку: эксперты «Ростелекома» оценили молодежные проекты на HSE Fest 2026 В Санкт-Петербурге при поддержке «Ростелекома» завершился всероссийский фестиваль университетских и школьных технологических проектов HSE Fest 2026. ...

13:36, 16 Дек Больше денег в немногие руки // Эксперты оценили перспективы рынка труда РФ в 2026 году В 2026 году российских работников большинства отраслей экономики ждет небольшое повышение зарплаты наряду с ростом рабочей нагрузки, следует из опрос...

06:36, 01 Апр Эксперты высоко оценили уровень системы управления охраной труда на Калининской АЭС в рамках плановой проверки На Калининской АЭС завершилась