В последнее время было много комментариев, восхваляющих Клода Кода, но, как давний пользователь, Opus 4.5 в наши дни имеет очевидные проблемы «снижения интеллекта». Как узнать, была ли модель понижена? Постоянные пользователи почувствуют, что некоторые задачи, которые, как ожидается, будут выполнены за 1 дубль, требуют 2-3 раза, чтобы достичь стандарта.
Очень субъективно? верно! Однако позвольте мне представить вам человека по имени Сайт Stupid-Meter. Он анализирует надежность текущих основных моделей и постоянно обновляется.
На момент написания самой высокой надежностью обладает SONNET 4 (а не 4.5), тогда как GPT 5.2 занимает второе место, а Opus 4.5 лишь пятое. Что касается Gemini 3 Pro Preview, то он занимает 10 место. Я не уверен, действительно ли SONNET 4 более стабилен, чем 4.5, но я думаю, что недавний Кодекс GPT 5.2 (High) более надежен, чем Opus 4.5. Что касается Gemini 3 Pro, то он занимает лишь 10-е место, что весьма разумно. Кто им пользуется, тот знает.
Модели искусственного интеллекта иногда снижают качество своей продукции из-за слишком большого количества пользователей и высокого спроса. Конечно, также могут быть некоторые ошибки или сбои, которые влияют на производительность вывода. Поэтому хорошей привычкой является часто проверять Stupid-Meter, прежде чем решить, какую модель использовать.
2026-01-10 23:27:00
1768089592
#Клод #Опус #Был #тайно #обезглавлен #Вебсайт #сообщает #вам #текущую #надежность #моделей #искусственного #интеллекта
Читайте также

