Сравнение GPT-5.5 и ChatGPT Images 2 на живых задачах
Разбор практического сравнения моделей на живых задачах вместо тестовых таблиц: разбор медицинских данных, вёрстка страницы для кафе, воссоздание уровня старой игры по скриншоту. Результат неоднозначный: одна модель точнее в разборе данных и в переносе картинки в работающий код, но выдаёт чувствительные подробности без оглядки на приличия; вторая осторожнее и структурнее, но слабее в исполнении. Отдельная линия — навязчивая услужливость, из-за которой автор в своё время отказался от подписки.
GPT-5.5 с Codex — стандарт для кода, Opus — для креатива, но будущее за индивидуальностью.
Не выбирать одну модель на всё, а закрепить за задачами: одна для оформления и вёрстки, другая для разбора данных и текста — и один раз проверить это на своих типовых заказах. Второй момент важнее: модель, которая охотно цитирует чувствительные подробности, не должна касаться персональных данных клиентов заказчика — это выбор, который делается до подключения, а не после жалобы.