1759950499
2025-10-08 18:30:00
С тех пор, как в январе на сцену вышел DeepSeek, возрос интерес к китайским моделям искусственного интеллекта с открытым исходным кодом. Некоторые исследователи настаивают на еще более открытом подходе к созданию ИИ, который позволит распространять создание моделей по всему миру.
Главный интеллектстартап, специализирующийся на децентрализованном искусственном интеллекте, в настоящее время обучает передовую модель большого языка под названием ИНТЕЛЛЕКТ-3, используя новый вид распределенного обучения с подкреплением для точной настройки. Модель продемонстрирует новый способ создания конкурентоспособных открытых моделей искусственного интеллекта с использованием разнообразного оборудования в разных местах, не прибегая к помощи крупных технологических компаний, говорит Винсент Вайссер, генеральный директор компании.
Вайссер говорит, что мир искусственного интеллекта в настоящее время разделен на тех, кто полагается на закрытые американские модели, и тех, кто использует открытые китайские предложения. Технология, которую разрабатывает Prime Intellect, демократизирует ИИ, позволяя большему количеству людей создавать и модифицировать передовой ИИ для себя.
Улучшение моделей ИИ больше не является вопросом простого увеличения объема обучающих данных и вычислений. Сегодняшние пограничные модели используют обучение с подкреплением для улучшения после завершения процесса предварительного обучения. Хотите, чтобы ваша модель преуспела в математике, отвечала на юридические вопросы или играла в судоку? Пусть он самосовершенствуется, практикуясь в среде, где вы можете измерить успех и неудачу.
«Эти среды обучения с подкреплением теперь являются узким местом для реального масштабирования возможностей», — говорит мне Вайссер.
Компания «Прайм-Интеллект» создала платформу, которая позволяет каждому создать среду обучения с подкреплением, адаптированную для конкретной задачи. Компания объединяет лучшие среды, созданные собственной командой и сообществом для настройки ИНТЕЛЛЕКТ-3.
Я попробовал запустить среду для решения головоломок Wordle, созданную исследователем Prime Intellect Уиллом Брауном, наблюдая, как маленькая модель решает головоломки Wordle (честно говоря, она была более методична, чем я). Если бы я был исследователем искусственного интеллекта, пытающимся улучшить модель, я бы включил несколько графических процессоров и снова и снова практиковал модель, в то время как алгоритм обучения с подкреплением изменял ее веса, превращая таким образом модель в мастер Wordle.
#Этот #стартап #хочет #спровоцировать #момент #DeepSeek #США
Ещё по этой теме
