Профессор Гонконгского университета науки и технологий фактически проверил «обман» очков искусственного интеллекта: легко победил 95% студентов за 30 минут, раскрывая дилемму традиционной оценки преподавания.

Эксперимент, проведенный в Гонконгском университете науки и технологий, показал, что очки искусственного интеллекта, оснащенные большой языковой моделью, набрали высокий балл 92,5 на выпускном экзамене всего за 30 минут, превзойдя 95% студентов.

Команда профессора Чжан Цзюня и профессора Мэн Цзили из Гонконгского университета науки и технологий недавно провела довольно смелый эксперимент. Они установили пару очков искусственного интеллекта, оснащенных моделью ChatGPT-5.2, в аудиторию выпускных экзаменов университета. В результате испытуемый, не являющийся человеком, всего за 30 минут набрал высокий балл 92,5, значительно превзойдя 95% студентов-людей. Этот реальный тест не только доказал силу современного оборудования искусственного интеллекта в сочетании с крупномасштабными языковыми моделями, но и напрямую повлиял на систему оценки преподавания, к которой мы привыкли.

Очки искусственного интеллекта превращаются в инструмент мошенничества, сметая выпускные экзамены в колледже

Это действительно преувеличение. На этот раз ИИ вломился в экзаменационную комнату университета как мошенник. Инцидент произошел на месте проведения выпускного экзамена по курсу «Принципы компьютерных сетей» Гонконгского университета науки и технологий. Пара очков искусственного интеллекта, оснащенных моделью ChatGPT-5.2, выполнила весь тестовый лист в смоделированной ситуации реального экзамена.

Результаты были шокирующими: очки были сданы всего за 30 минут и набрали 92,5 балла. В рейтинге производительности более 100 человек он сразу вошел в пятерку лучших, легко победив более 95% присутствующих кандидатов-людей. Раньше мошенничество основывалось на шпаргалках, но теперь мошенничество предполагает прямое ношение целого компьютера. Однако, когда ИИ уже может идеально выполнять процесс экзамена, все беспокоятся не только о том, будут ли студенты использовать его для мошенничества, но и о том, следует ли пересмотреть нашу экзаменационную систему.

В конкуренции между программным и аппаратным обеспечением очки Rokid выделяются среди остальных.

Эта битва человека и машины на самом деле является тщательно спланированным экспериментом команды профессора. Их цель ясна: позволить ИИ-очкам открыто жульничать и посмотреть, сколько очков они смогут набрать. Темой теста являются принципы компьютерных сетей, которые являются головной болью для многих студентов-инженеров. Этот курс полон профессиональных концепций, логических выводов и алгоритмов.

Read more:  Междунареют ли крупные языковые модели о агентах искусственного интеллекта?

Чтобы дать возможность ИИ-кандидатам показать свою силу, команда потратила много усилий на выбор оборудования. Они оценили 12 основных умных очков на рынке, включая такие бренды, как Meta, Xiaomi и Rokid. После первого раунда проверки выяснилось, что продуктов со встроенными линзами и встроенными дисплеями не так много. В конце концов, Meta Ray-Ban, Frame и Rokid остались сделать окончательный выбор.

Хоть очки Меты и очень красные, они не могут удовлетворить экспериментальные нужды, поскольку нет интерфейса управления отображением контента. Для сравнения, инструменты разработки Rokid относительно полны и имеют более высокую степень свободы. Кроме того, учитывая влияние качества изображения камеры на распознавание тестового листа, команда в конечном итоге выбрала очки Rokid AI в качестве аппаратного игрока. Что касается мозговой части, команда остановилась на модели OpenAI ChatGPT-5.2 (примечание: исходный текст может относиться к конкретной доработанной версии или модели), оценив ее скорость отклика и общие знания.

Процесс мошенничества очень гладкий, но есть сокрытия

Процесс экзамена очень плавный: студенты смотрят на контрольную работу, линзы на очках быстро фиксируют вопросы, а большая языковая модель в облаке отправляется в облако через Wi-Fi для вывода. Сгенерированные ответы затем отправляются обратно на экран очков, и учащимся остается их только скопировать.

Результаты показывают, что очки Rokid набрали полную оценку как за вопросы с несколькими вариантами ответов, так и за вопросы с короткими ответами. Даже за сложные вопросы с краткими ответами на нескольких страницах он смог получить большую часть баллов, полагаясь на сильные контекстуальные логические выводы. Несмотря на то, что в самых сложных частях расчета иногда случаются ошибки, этапы вывода в середине хорошо написаны.

Read more:  RoboTeach: платформа интерактивного обучения на базе искусственного интеллекта

Однако этот тест также выявил недостатки нынешних коммерческих очков AI, а именно энергопотребление и выделение тепла. При включенном Wi-Fi и непрерывной передаче изображений с высоким разрешением заряд батареи упал со 100% до 58% всего за 30 минут тестирования. Это означает, что если очки с искусственным интеллектом будут использоваться в течение всего дня, то в технологии аккумуляторов еще есть много возможностей для совершенствования. Кроме того, четкость линзы также имеет решающее значение. Если вопрос рефлексивный или ракурс неправильный, ИИ будет ослеплен, что приведет к снижению точности ответа.

Традиционные экзамены измеряют только результаты, но ИИ выигрывает в результатах

Этот эксперимент нанес тяжелый удар по миру образования: хотя мы все еще используем стандартные ответы для оценки учащихся, именно в этой области ИИ работает лучше всего. Большинство экзаменов с детства до взрослой жизни проверяют память и стандартные процедуры решения задач. Этот метод работал в прошлом, потому что человеческий мозг имеет индивидуальные различия в памяти и расчетах. Но теперь ИИ может запоминать и рассчитывать быстрее вас, и его руки не будут дрожать, когда вы нервничаете.

Например, некоторые люди раньше модифицировали умные очки Meta для жульничества в шахматных матчах, и ИИ всегда может дать лучшее решение. Исследование Университета Рединга в Великобритании также показало, что после того, как тестовые задания, созданные ИИ, были смешаны с банком вопросов, 94% из них успешно обманули учителей и получили более высокие оценки, чем реальные люди.

Это неловко. По сравнению с одобрениями и СОПами по решению проблем люди просто не могут победить ИИ. Это заставляет нас переосмыслить: что именно измеряет экзамен?

Реформа образования: от раздачи ответов к раздаче идей

Настоящие способности к обучению, такие как задавать хорошие вопросы, выносить суждения при недостаточности информации, взвешивать различные варианты и сопереживать, являются сильными сторонами человека, и их трудно проверить с помощью традиционных письменных тестов. Будущие методы оценки должны перейти от рассмотрения результатов к рассмотрению процессов.

Read more:  Потратил, но не переизлова: как игрушечные свопы справляются с отходами в Австралии, по одному плюшевому за раз | Напрасно тратить

Педагогические психологи уже давно говорят, что человеческий интеллект разнообразен. Но в рамках стандартизированных тестов уточняются и проверяются только логические, математические и языковые навыки. Теперь, когда ИИ может проводить стандартизированное тестирование, мы должны тестировать то, чего ИИ не может.

Некоторые школы за рубежом уже начали меняться. Например, Школа бизнеса Нью-Йоркского университета ввела устные экзамены с помощью искусственного интеллекта. Студентам предстоит не только сдать домашнее задание, но и объяснить логику принятия решений экзаменатору по искусственному интеллекту на месте. Дело уже не в том, какой ответ вы написали, а в том, почему вы так думаете.

Присоединяйтесь к фан-группе TXBang в Facebook
2026-01-16 08:30:00


1768577534
#Профессор #Гонконгского #университета #науки #технологий #фактически #проверил #обман #очков #искусственного #интеллекта #легко #победил #студентов #за #минут #раскрывая #дилемму #традиционной #оценки #преподавания

По теме

Leave a Comment

This site uses Akismet to reduce spam. Learn how your comment data is processed.