Пусть ИИ перестанет быть черным ящиком, а будет цивилизованной сетью, способной к самоцензуре.
Когда злоумышленники также используют ИИ для проведения атак, антивирусных идей одной модели или закрытого поставщика уже недостаточно для защиты экосистемы. Алан предложил другой путь: сделать антивирусное сообщество мульти-ИИ, которое сможет самопроверяться, проверяться и развиваться вместе.
Предыстория: Почему нам нужно переосмыслить антивирус сейчас?
В последние годы возможности, предоставляемые генеративным искусственным интеллектом, не только использовались для ускорения защиты, но также использовались злоумышленниками для автоматического создания вариантов вредоносных образцов и предотвращения сравнения сигнатур и обнаружения традиционных функций. Традиционные антивирусные привычки полагаются на сигнатуры, единую модель или централизованные обновления, которые стали пассивными и уязвимыми перед лицом автоматизированных и быстро меняющихся атак.
Более серьезной проблемой является «доверие»: передача критических обновлений и стратегий одному поставщику в долгосрочной перспективе создаст монополию, риски бэкдора и неправомерное использование данных. Отправной точкой Алана является создание доверия, а не вверение доверия отдельным лицам или компаниям.
Основная концепция: Что такое Алан?
Alan (Autonomous Learning Arbitration Network) — это не отдельное программное обеспечение, а конструкция системы «взаимного обзора нескольких ИИ + проверяемого управления». Он действует на трех уровнях:
1. Мультиагентная атака и защита (красный/синий)
Синий: несколько независимых защитных ИИ, каждый из которых предлагает правила обнаружения и стратегии защиты, проверяют результаты друг друга.
Красный: Специализируется на создании образцов атак и новых методах обхода, заставляя синюю команду развиваться в изолированной песочнице.
2. Арбитры
арбитрОтвечает за перевод языка команды (внутреннее представление модели) в отчет, понятный людям и системам аудита, и расчет количественного показателя:Достоверность перевода (TC)(Взвешенные показатели, такие как достоверность перевода и последовательность обратного перевода).
Вывод арбитража сопровождается двусторонним хешем и TC, которые записываются в аудиторскую книгу и не могут быть изменены.
3. Управление, голосование и откат (Управление + РВК)
Все важные предложения поступают Анонимное проверяемое голосование(Принимая идею микснета/нулевого разглашения), если порог будет достигнут, сначала будет Canary, а затем он будет полностью реализован, если производительность стабильна. Если KPI и индекс риска не уточнены, система автоматически Откат (РВК) и инициировать внешний аудит.
матрица управленияВ качестве единого источника истины (конституции системы) определите пороговые значения, разрешения и условия отката.
(упрощенная схема)
[Red Teams] ⇄ [Blue Teams] ⇄ [Arbiters]
│ │ │
└───→ Governance Matrix ───→ Audit Chain
│
↓
Canary → RVC Rollback
Почему Алан имеет смысл?
Интеграция технологий в управление: Соединить конституционное управление (матрицу управления) и инженерные процессы (TC, откат, якорь Меркла), чтобы система не только стала сильнее, но также подвергалась аудиту и подотчетности.
Доверие – это не обещание, это процесс: Внешний аудит и неизменяемые журналы основывают «достоверность» на поддающихся проверке доказательствах, а не на устных обещаниях или обещаниях производителя.
Может быть развернуто постепенно: Можно сначала сделать уменьшенную версию MVP (например, 3 синих, 1 красную, 1 арбитражную), а затем расширить после проверки замкнутого цикла, чтобы снизить первоначальные затраты и риски.
С чего начать (для тех из вас, у кого нет ресурсов)
Для начала вам не нужна большая команда или много серверов. Поэтапную стратегию можно принять:
Общественное видение (сейчас): сначала опубликуйте концепцию, чтобы сформировать временную метку и видимость для сообщества (этот шаг выполнен).
Небольшой прототип (краткосрочный): Используйте общедоступные или синтетические данные для моделирования процесса «Арбитраж → TC → Голосование → Канарские → Откат» в контролируемой среде и выведите простой отчет.
Проверка сообщества (среднесрочная): Привлекать исследовательские группы или сообщества безопасности для создания тестового пула Red-Blue с открытым исходным кодом.
Внешний аудит и расширение управления (долгосрочная перспектива): Представляем сторонний аудит и управление на основе DAO.
Какая помощь мне нужна?
Если вы:
- Исследователь безопасности/инженер ML → Надеюсь, вы сможете сделать экспертную оценку модели TC или помочь сделать небольшой прототип.
- Студенты/энтузиасты открытого исходного кода → Вы можете смоделировать противостояние красно-синих на небольшом наборе данных и отправить отчет об испытаниях.
- Компании или консультанты с ресурсами → Я приветствую пилотное сотрудничество и внешний аудит.
Контакт и оригинальный текст проекта:
👉 Официальная страница (белая книга): https://panny542264944-ai.github.io/AlanProject/
(Полный текст написан на традиционном китайском языке; вы можете использовать инструмент перевода, чтобы прочитать его, или связаться со мной, чтобы запросить краткую версию на английском языке)
Заявление и разрешение
Эта статьяконцептуальное предложениес проектом публичного видения и некоммерческим описанием продукта. Детали (такие как полный псевдокод, конкретные пороговые значения и т. д.) в общедоступной версии умеренно скрыты во избежание злоупотреблений.
Alan Project © 2025 Юй Цяньхуан — под лицензией CC BY-NC 4.0.(Подпись – Некоммерческий)
2025-10-10 01:20:00
1760060574
#Алан #автономно #развивающаяся #архитектура #антивирусного #управления #управления #доверием #несколькими #искусственными #интеллектами #Пусть #ИИ #перестанет #быть #черным #ящиком #будет #цивилизованной #сетью #способной #самоцензуре #Хуан #Юйцянь #Октябрь
Продолжение темы

