Кое-что из того, что нужно знать о свежем релизе GPT-5 и о чём молчат евангелисты:

  1. GPT-5 не является одной моделью. То, что называют GPT-5 вне контекста API, — это роутер, который отправляет ваш запрос той модели, которая, по его мнению, справится с ним эффективнее всего. Обещание OpenAI дать доступ каждому нужно рассматривать именно в этом свете. Доступ дают к роутеру, и вы не знаете, какую конфигурацию он применяет к вам и удастся ли вам вообще протестировать самую мощную модель. Это неизбежно приводит к совершенно разному опыту у разных пользователей.

  2. GPT-5 не является PhD. Это довольно способная модель (по крайней мере, одна из), которая блистает в некоторых задачах. Улучшений можно ожидать в:

    • способностях к кодингу (по некоторым вайб-тестам они впечатляют, но по бенчмарку SWE-bench Verified отрыв от Claude Opus 4.1 совсем небольшой);
    • вызове инструментов — а это самое важное для агентных нагрузок;
    • других задачах, где у OpenAI был доступ к немедленной обратной связи.

    Для многих областей это важные улучшения, но уровня PhD они модели не дают. Галлюцинация про профиль крыла во время демо отлично показывает, что модель по-прежнему усваивает самое распространённое мнение, а не самое актуальное. Это очень трудная проблема, и на пути к AGI она остаётся одним из главных препятствий.

  3. Снижение числа галлюцинаций — палка о двух концах. С одной стороны, чем меньше модель галлюцинирует, тем лучше: ей можно больше доверять. С другой стороны, чем больше вы доверяете модели, тем выше шанс пропустить настоящие галлюцинации. В реальном мире лучше всех модель, которая не галлюцинирует никогда. Модель, галлюцинирующая в 0.01% случаев, может оказаться опаснее той, что галлюцинирует в 10%.

Моё личное впечатление пока такое: у неё та же проблема, что и у предыдущих моделей OpenAI, — без аккуратного промптинга она крайне поверхностна. Она выдаёт самый неглубокий анализ, какой только сойдёт ей с рук, и маскирует это очень хорошо структурированными ответами.