Алан — автономно развивающаяся архитектура антивирусного управления и управления доверием с несколькими искусственными интеллектами. Пусть ИИ перестанет быть черным ящиком, а будет цивилизованной сетью, способной к самоцензуре. | Хуан Юйцянь | Октябрь 2025 г.

Пусть ИИ перестанет быть черным ящиком, а будет цивилизованной сетью, способной к самоцензуре.

Когда злоумышленники также используют ИИ для проведения атак, антивирусных идей одной модели или закрытого поставщика уже недостаточно для защиты экосистемы. Алан предложил другой путь: сделать антивирусное сообщество мульти-ИИ, которое сможет самопроверяться, проверяться и развиваться вместе.

Нажмите Enter или нажмите, чтобы просмотреть изображение в полном размере

Предыстория: Почему нам нужно переосмыслить антивирус сейчас?

В последние годы возможности, предоставляемые генеративным искусственным интеллектом, не только использовались для ускорения защиты, но также использовались злоумышленниками для автоматического создания вариантов вредоносных образцов и предотвращения сравнения сигнатур и обнаружения традиционных функций. Традиционные антивирусные привычки полагаются на сигнатуры, единую модель или централизованные обновления, которые стали пассивными и уязвимыми перед лицом автоматизированных и быстро меняющихся атак.

Более серьезной проблемой является «доверие»: передача критических обновлений и стратегий одному поставщику в долгосрочной перспективе создаст монополию, риски бэкдора и неправомерное использование данных. Отправной точкой Алана является создание доверия, а не вверение доверия отдельным лицам или компаниям.

Основная концепция: Что такое Алан?

Alan (Autonomous Learning Arbitration Network) — это не отдельное программное обеспечение, а конструкция системы «взаимного обзора нескольких ИИ + проверяемого управления». Он действует на трех уровнях:

1. Мультиагентная атака и защита (красный/синий)

Синий: несколько независимых защитных ИИ, каждый из которых предлагает правила обнаружения и стратегии защиты, проверяют результаты друг друга.

Красный: Специализируется на создании образцов атак и новых методах обхода, заставляя синюю команду развиваться в изолированной песочнице.

2. Арбитры

арбитрОтвечает за перевод языка команды (внутреннее представление модели) в отчет, понятный людям и системам аудита, и расчет количественного показателя:Достоверность перевода (TC)(Взвешенные показатели, такие как достоверность перевода и последовательность обратного перевода).

Read more:  Перед центром внимания «Сайяра»! Когда Ананя Пандей праздновала Ракша Бандхан практически с Ахаан Пандай во время блокировки 2020 года | Новости фильма на хинди

Вывод арбитража сопровождается двусторонним хешем и TC, которые записываются в аудиторскую книгу и не могут быть изменены.

3. Управление, голосование и откат (Управление + РВК)

Все важные предложения поступают Анонимное проверяемое голосование(Принимая идею микснета/нулевого разглашения), если порог будет достигнут, сначала будет Canary, а затем он будет полностью реализован, если производительность стабильна. Если KPI и индекс риска не уточнены, система автоматически Откат (РВК) и инициировать внешний аудит.

матрица управленияВ качестве единого источника истины (конституции системы) определите пороговые значения, разрешения и условия отката.

(упрощенная схема)

[Red Teams] ⇄ [Blue Teams] ⇄ [Arbiters]
│ │ │
└───→ Governance Matrix ───→ Audit Chain


Canary → RVC Rollback

Почему Алан имеет смысл?

Интеграция технологий в управление: Соединить конституционное управление (матрицу управления) и инженерные процессы (TC, откат, якорь Меркла), чтобы система не только стала сильнее, но также подвергалась аудиту и подотчетности.

Доверие – это не обещание, это процесс: Внешний аудит и неизменяемые журналы основывают «достоверность» на поддающихся проверке доказательствах, а не на устных обещаниях или обещаниях производителя.

Может быть развернуто постепенно: Можно сначала сделать уменьшенную версию MVP (например, 3 синих, 1 красную, 1 арбитражную), а затем расширить после проверки замкнутого цикла, чтобы снизить первоначальные затраты и риски.

С чего начать (для тех из вас, у кого нет ресурсов)

Для начала вам не нужна большая команда или много серверов. Поэтапную стратегию можно принять:

Общественное видение (сейчас): сначала опубликуйте концепцию, чтобы сформировать временную метку и видимость для сообщества (этот шаг выполнен).

Небольшой прототип (краткосрочный): Используйте общедоступные или синтетические данные для моделирования процесса «Арбитраж → TC → Голосование → Канарские → Откат» в контролируемой среде и выведите простой отчет.

Read more:  Эиф ван Опдорп объясняет, как остановить тихую утечку денег

Проверка сообщества (среднесрочная): Привлекать исследовательские группы или сообщества безопасности для создания тестового пула Red-Blue с открытым исходным кодом.

Внешний аудит и расширение управления (долгосрочная перспектива): Представляем сторонний аудит и управление на основе DAO.

Какая помощь мне нужна?

Если вы:

  • Исследователь безопасности/инженер ML → Надеюсь, вы сможете сделать экспертную оценку модели TC или помочь сделать небольшой прототип.
  • Студенты/энтузиасты открытого исходного кода → Вы можете смоделировать противостояние красно-синих на небольшом наборе данных и отправить отчет об испытаниях.
  • Компании или консультанты с ресурсами → Я приветствую пилотное сотрудничество и внешний аудит.

Контакт и оригинальный текст проекта:
👉 Официальная страница (белая книга): https://panny542264944-ai.github.io/AlanProject/
(Полный текст написан на традиционном китайском языке; вы можете использовать инструмент перевода, чтобы прочитать его, или связаться со мной, чтобы запросить краткую версию на английском языке)

Заявление и разрешение

Эта статьяконцептуальное предложениес проектом публичного видения и некоммерческим описанием продукта. Детали (такие как полный псевдокод, конкретные пороговые значения и т. д.) в общедоступной версии умеренно скрыты во избежание злоупотреблений.
Alan Project © 2025 Юй Цяньхуан — под лицензией CC BY-NC 4.0.(Подпись – Некоммерческий)

2025-10-10 01:20:00


1760060574
#Алан #автономно #развивающаяся #архитектура #антивирусного #управления #управления #доверием #несколькими #искусственными #интеллектами #Пусть #ИИ #перестанет #быть #черным #ящиком #будет #цивилизованной #сетью #способной #самоцензуре #Хуан #Юйцянь #Октябрь

Продолжение темы

Leave a Comment

This site uses Akismet to reduce spam. Learn how your comment data is processed.