ИИ с открытым исходным кодом обрезал для эффективности, созданные подробные инструкции по изготовлению бомб и другие плохие ответы перед переподготовкой


  • Исследователи UCR переписывают модели искусственного интеллекта, чтобы сохранить безопасность нетронутой при обрезании для небольших устройств
  • Изменение выходящих слоев удаляет защиту, переподготовка восстанавливает заблокированные небезопасные ответы
  • Исследование с использованием Llava 1.5 показало, что сниженные модели отказались от опасных подсказок после обучения

Исследователи из Калифорнийского университета, Риверсайд, решают проблему ослабленной безопасности в моделях искусственного интеллекта с открытым исходным кодом, когда они адаптированы для небольших устройств.

Поскольку эти системы обрезаны для эффективного запуска на телефонах, автомобилях или другом оборудовании с низким энергопотреблением, они могут потерять гарантии, предназначенные для того, чтобы они не создавали оскорбительный или опасный материал.

2025-09-15 23:00:00


1757978470
#ИИ #открытым #исходным #кодом #обрезал #для #эффективности #созданные #подробные #инструкции #по #изготовлению #бомб #другие #плохие #ответы #перед #переподготовкой

По теме

Leave a Comment

This site uses Akismet to reduce spam. Learn how your comment data is processed.